{"as_of":"2026-08-05T21:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:419b93aa59b8bc27e12df7670208e999cb10844b924846e38f28c7215d94e2fa","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":19,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T00:24:08.131704Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T14:19:54.283579Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":"2412.03304","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-07-04T14:19:54.283579Z","title":"arXiv preprint arXiv:2412.03304 , year=","venue":null,"work_id":"c66cac0b-c1be-43c0-ba5e-f2168c18ba30","year":2024},"citing_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-05-19T05:48:02.828938Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2507.06261"},"observation_digest":"sha256:d2c637f1e52fdf7239794a96114be9d92ecf0f6b44e6f5aacd903b650e876bf8","observation_id":"5e020e07-84e8-46fd-ab00-b4d1c61bcd06","resolution":{"observed_at":"2026-05-19T05:52:07.901883Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":"2412.03304","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-07-04T14:19:54.283579Z","title":"arXiv preprint arXiv:2412.03304 , year=","venue":null,"work_id":"c66cac0b-c1be-43c0-ba5e-f2168c18ba30","year":2024},"citing_paper":{"arxiv_id":"2507.23009","last_updated":"2026-05-11T11:47:15Z","snapshot_observed_at":"2026-07-06T22:05:22.373440Z","submitted_at":"2025-07-30T18:14:35Z","title":"Position: Stop Evaluating AI with Human Tests, Develop Principled, AI-specific Tests instead","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-19T02:12:48.586913Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2507.23009"},"observation_digest":"sha256:28685de2cb75594e89ee8f732aa4e3ab899bc7ee3d80fdf7ce5972be0cb03c18","observation_id":"f647a286-adac-4b2e-a8d2-d93469368f51","resolution":{"observed_at":"2026-05-19T02:12:55.737216Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":"2412.03304","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-07-04T14:19:54.283579Z","title":"arXiv preprint arXiv:2412.03304 , year=","venue":null,"work_id":"c66cac0b-c1be-43c0-ba5e-f2168c18ba30","year":2024},"citing_paper":{"arxiv_id":"2511.02135","last_updated":"2026-04-16T08:31:14Z","snapshot_observed_at":"2026-08-02T06:20:11.557622Z","submitted_at":"2025-11-03T23:54:24Z","title":"Graph-Based Alternatives to LLMs for Human Simulation","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-05-18T00:47:40.432039Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2511.02135"},"observation_digest":"sha256:4856eeb91daf0f387469c6a6bc2d6b4b1d695480cab6b16365c2634e70cb52dd","observation_id":"6ba11cd8-df58-4c09-af34-fcc7c13e25af","resolution":{"observed_at":"2026-05-18T00:50:33.234179Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":"2412.03304","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-07-04T14:19:54.283579Z","title":"arXiv preprint arXiv:2412.03304 , year=","venue":null,"work_id":"c66cac0b-c1be-43c0-ba5e-f2168c18ba30","year":2024},"citing_paper":{"arxiv_id":"2512.20856","last_updated":"2025-12-24T00:24:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-24T00:24:05Z","title":"NVIDIA Nemotron 3: Efficient and Open Intelligence","version":1},"reference_index":143,"source":"arxiv_source","source_observed_at":"2026-05-18T01:40:42.190369Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2512.20856"},"observation_digest":"sha256:854213a23abce25426541cadec6b707ec98892c9b3bc80c299af473e5c9a47d7","observation_id":"0ebbb4df-ea35-4e5c-b87b-66b8901b4c5c","resolution":{"observed_at":"2026-05-18T01:40:42.653286Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-08-02T22:31:50.017966Z","title":"Siddhant, A., Hu, J., Johnson, M., Firat, O., and Ruder, S","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.16763","last_updated":"2026-06-29T17:01:58Z","snapshot_observed_at":"2026-08-02T22:31:47.931184Z","submitted_at":"2026-02-18T16:51:37Z","title":"When AI Benchmarks Plateau: A Systematic Study of Benchmark Saturation","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T22:31:50.017966Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2602.16763"},"observation_digest":"sha256:2b432b4c83eb26b85438384e5ae10bd004709aa152d7e2eec5564d335a41c022","observation_id":"9185ab9c-7987-4f7e-bc58-a4d9312e495b","resolution":{"observed_at":"2026-08-02T22:31:50.017966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":"2412.03304","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-07-04T14:19:54.283579Z","title":"arXiv preprint arXiv:2412.03304 , year=","venue":null,"work_id":"c66cac0b-c1be-43c0-ba5e-f2168c18ba30","year":2024},"citing_paper":{"arxiv_id":"2604.18914","last_updated":"2026-04-20T23:35:24Z","snapshot_observed_at":"2026-07-06T23:05:39.724237Z","submitted_at":"2026-04-20T23:35:24Z","title":"MORPHOGEN: A Multilingual Benchmark for Evaluating Gender-Aware Morphological Generation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-10T04:04:12.610168Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2604.18914"},"observation_digest":"sha256:b68b1c3a9e2acc84df99a7291a79ca30431abd1ae60efda6544fb35f11845c11","observation_id":"f893290f-f430-4026-bc79-5fd4bde3f86c","resolution":{"observed_at":"2026-05-11T12:11:08.220134Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":"2412.03304","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-07-04T14:19:54.283579Z","title":"arXiv preprint arXiv:2412.03304 , year=","venue":null,"work_id":"c66cac0b-c1be-43c0-ba5e-f2168c18ba30","year":2024},"citing_paper":{"arxiv_id":"2604.20720","last_updated":"2026-04-22T16:07:10Z","snapshot_observed_at":"2026-07-06T23:07:25.185196Z","submitted_at":"2026-04-22T16:07:10Z","title":"COMPASS: COntinual Multilingual PEFT with Adaptive Semantic Sampling","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-10T01:14:16.831333Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2604.20720"},"observation_digest":"sha256:c9fcefa42ffa2c5e6bb723d3fe5329f9b36e8b3bb6cd053e634283598d720fa8","observation_id":"8637deb7-4d4c-4ca6-ace2-6a6581d745d2","resolution":{"observed_at":"2026-05-11T13:41:05.490905Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":"2412.03304","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-07-04T14:19:54.283579Z","title":"arXiv preprint arXiv:2412.03304 , year=","venue":null,"work_id":"c66cac0b-c1be-43c0-ba5e-f2168c18ba30","year":2024},"citing_paper":{"arxiv_id":"2604.24544","last_updated":"2026-04-27T14:39:41Z","snapshot_observed_at":"2026-07-06T23:10:33.821313Z","submitted_at":"2026-04-27T14:39:41Z","title":"STELLAR-E: a Synthetic, Tailored, End-to-end LLM Application Rigorous Evaluator","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-08T03:39:30.528601Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2604.24544"},"observation_digest":"sha256:3902e2f23c9f7080bd04024de7a3d05aa3377b2d6fe1820b14fef1822f51d237","observation_id":"edad3d95-9560-4be5-8b82-db420c9c8fdc","resolution":{"observed_at":"2026-05-11T22:01:10.977384Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":"2412.03304","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-07-04T14:19:54.283579Z","title":"arXiv preprint arXiv:2412.03304 , year=","venue":null,"work_id":"c66cac0b-c1be-43c0-ba5e-f2168c18ba30","year":2024},"citing_paper":{"arxiv_id":"2605.22137","last_updated":"2026-05-25T06:02:57Z","snapshot_observed_at":"2026-08-03T03:39:05.853147Z","submitted_at":"2026-05-21T08:11:01Z","title":"Cross-Lingual Consensus: Aligning Multilingual Cultural Knowledge via Multilingual Self-Consistency","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-22T06:36:05.506175Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2605.22137"},"observation_digest":"sha256:0213fe5549a7b6415bf36d6822baa94c660e20914e89154e9440d94833529494","observation_id":"85cc8893-912a-4af4-a033-5d8ac039d995","resolution":{"observed_at":"2026-05-22T06:36:10.018113Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":"2412.03304","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-07-04T14:19:54.283579Z","title":"arXiv preprint arXiv:2412.03304 , year=","venue":null,"work_id":"c66cac0b-c1be-43c0-ba5e-f2168c18ba30","year":2024},"citing_paper":{"arxiv_id":"2605.22137","last_updated":"2026-05-25T06:02:57Z","snapshot_observed_at":"2026-08-03T03:39:05.853147Z","submitted_at":"2026-05-21T08:11:01Z","title":"Cross-Lingual Consensus: Aligning Multilingual Cultural Knowledge via Multilingual Self-Consistency","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-30T17:31:39.958584Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2605.22137"},"observation_digest":"sha256:04dabb539775e07c7fc9320695b8e6f609dc4400751d1ef94fd720de8df80084","observation_id":"066f8156-3bc4-4da6-b54d-2a1cc7bf54aa","resolution":{"observed_at":"2026-06-30T17:34:57.558733Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":"2412.03304","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-07-04T14:19:54.283579Z","title":"arXiv preprint arXiv:2412.03304 , year=","venue":null,"work_id":"c66cac0b-c1be-43c0-ba5e-f2168c18ba30","year":2024},"citing_paper":{"arxiv_id":"2605.24904","last_updated":"2026-05-24T07:06:34Z","snapshot_observed_at":"2026-08-02T01:32:33.957411Z","submitted_at":"2026-05-24T07:06:34Z","title":"Quantifying the Impact of Translation Errors on Multilingual LLM Evaluation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T12:14:02.815700Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2605.24904"},"observation_digest":"sha256:4cf6441ebf85ab1dd7fb7013b7dee074a913f8c5509d3103d401d85201e5b669","observation_id":"aef667c6-d7f3-4a0f-8b1c-de52758e519c","resolution":{"observed_at":"2026-06-30T12:14:38.909100Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":"2412.03304","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-07-04T14:19:54.283579Z","title":"arXiv preprint arXiv:2412.03304 , year=","venue":null,"work_id":"c66cac0b-c1be-43c0-ba5e-f2168c18ba30","year":2024},"citing_paper":{"arxiv_id":"2605.26735","last_updated":"2026-05-26T09:11:32Z","snapshot_observed_at":"2026-07-06T23:36:34.652096Z","submitted_at":"2026-05-26T09:11:32Z","title":"Rethinking the Multilingual Reasoning Gap with Layer Swap","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T17:55:31.992163Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2605.26735"},"observation_digest":"sha256:fd943f5f44d6088c8526e32a6e63e8a3a34216396d6cd375af1b9d7d6f248753","observation_id":"b79a17a8-0469-4138-89d6-72b5a71f72d1","resolution":{"observed_at":"2026-06-29T18:03:48.213952Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":"2412.03304","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-07-04T14:19:54.283579Z","title":"arXiv preprint arXiv:2412.03304 , year=","venue":null,"work_id":"c66cac0b-c1be-43c0-ba5e-f2168c18ba30","year":2024},"citing_paper":{"arxiv_id":"2605.29128","last_updated":"2026-06-10T11:06:20Z","snapshot_observed_at":"2026-08-05T20:14:16.217767Z","submitted_at":"2026-05-27T21:40:10Z","title":"Apertus LLM Family Expansion via Distillation and Quantization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T13:27:47.476242Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2605.29128"},"observation_digest":"sha256:dd673ef6922842a19f6a53d834ef6fbaa908c5d90b97d3d848a7dce9f4b44fb0","observation_id":"3696b5ed-f64c-47c1-8591-79c84cc2a37c","resolution":{"observed_at":"2026-06-29T13:33:28.256681Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":"2412.03304","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-07-04T14:19:54.283579Z","title":"arXiv preprint arXiv:2412.03304 , year=","venue":null,"work_id":"c66cac0b-c1be-43c0-ba5e-f2168c18ba30","year":2024},"citing_paper":{"arxiv_id":"2605.31220","last_updated":"2026-06-23T21:17:04Z","snapshot_observed_at":"2026-08-03T19:20:09.115590Z","submitted_at":"2026-05-29T12:25:24Z","title":"Shared Doubt: Zero-Shot Cross-Lingual Confidence Estimation for Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T22:28:20.824883Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2605.31220"},"observation_digest":"sha256:4a1d009644aa131ed3ea7506f3d4b750a527317a63e8ba022ca3c5de3dd3ba06","observation_id":"37a19daf-a62a-472e-8837-8c7fb4680344","resolution":{"observed_at":"2026-06-28T22:32:44.271789Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":"2412.03304","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-07-04T14:19:54.283579Z","title":"arXiv preprint arXiv:2412.03304 , year=","venue":null,"work_id":"c66cac0b-c1be-43c0-ba5e-f2168c18ba30","year":2024},"citing_paper":{"arxiv_id":"2606.27306","last_updated":"2026-06-25T17:26:46Z","snapshot_observed_at":"2026-08-03T19:20:02.265864Z","submitted_at":"2026-06-25T17:26:46Z","title":"Multilingual Reasoning Cascades Need More Context","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T04:07:08.848920Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2606.27306"},"observation_digest":"sha256:b19f5eef2f3af28fdbe35693dc144f235f8fff0a6a78b2e7f617b41d161e0767","observation_id":"93af170c-01de-4c5b-9569-c75f654e2cdd","resolution":{"observed_at":"2026-07-04T14:19:54.285370Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":"2412.03304","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-07-04T14:19:54.283579Z","title":"arXiv preprint arXiv:2412.03304 , year=","venue":null,"work_id":"c66cac0b-c1be-43c0-ba5e-f2168c18ba30","year":2024},"citing_paper":{"arxiv_id":"2606.28345","last_updated":"2026-06-02T10:22:53Z","snapshot_observed_at":"2026-07-07T00:02:29.000757Z","submitted_at":"2026-06-02T10:22:53Z","title":"Auditing LLM-Governed Social Robots with Culture-Specific Moral Gradients","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-30T11:13:36.521513Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2606.28345"},"observation_digest":"sha256:0bc4acce009c62008765cd93d3074a9ea87e2eff89b2a626ccca483515d140bf","observation_id":"e1e79bb6-b0e0-4bfb-9df8-13fa83fd4424","resolution":{"observed_at":"2026-06-30T11:14:37.476780Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-08-01T23:50:17.232027Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15232","last_updated":"2026-07-16T17:32:38Z","snapshot_observed_at":"2026-08-05T12:26:35.447590Z","submitted_at":"2026-07-16T17:32:38Z","title":"In-Place Tokenizer Expansion for Pre-trained LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T23:50:17.232027Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2607.15232"},"observation_digest":"sha256:1a71d9aaa726788fd2712cfd676456d90a18e147194d1f1336da53de753ec9e9","observation_id":"40fb040e-78e9-4687-8003-0f6170f7b558","resolution":{"observed_at":"2026-08-01T23:50:17.232027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-08-01T15:28:19.272221Z","title":"Real-world translation: learning through engagement","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18432","last_updated":"2026-07-20T18:33:59Z","snapshot_observed_at":"2026-08-01T15:28:17.163351Z","submitted_at":"2026-07-20T18:33:59Z","title":"Building a European Multilingual Evaluation Dataset: The MMLU Localisation Project within the EMT Network","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T15:28:19.272221Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2607.18432"},"observation_digest":"sha256:af24302e689413c9310cfb4e0308622bcd338c23cc3703c93a611288ed955916","observation_id":"3db32d1b-02ce-49a8-ac76-0e61a02f0ad3","resolution":{"observed_at":"2026-08-01T15:28:19.272221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-08-03T00:24:08.131704Z","title":"acl-short.118/","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28801","last_updated":"2026-07-30T19:51:55Z","snapshot_observed_at":"2026-08-05T21:23:09.617959Z","submitted_at":"2026-07-30T19:51:55Z","title":"Benchmarks Are Not Monolithic: Sample-Level Auditing and Orchestration for LLM Evaluation","version":1},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-08-03T00:24:08.131704Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2607.28801"},"observation_digest":"sha256:3a4acc8c2140113e63abf36419dbc0da9acdbdd9d1ea1212c17ebad03a029201","observation_id":"01abc87a-b506-4d56-a5c8-6699f866b788","resolution":{"observed_at":"2026-08-03T00:24:08.131704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.03304/citation-record","integrity":"/paper/2412.03304/integrity","json":"/paper/2412.03304/citation-record.json","paper":"/paper/2412.03304"},"outbound":[],"paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 19 inbound Pith citation observations for arXiv:2412.03304."}