{"as_of":"2026-08-07T15:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:448eec38c17614d51b4bdf0757139655e7400d7029d5e8e5b7871799431e8361","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:19:59.488074Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T22:16:42.836058Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T08:09:41.063430Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"cited_work":{"arxiv_id":"2507.08538","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.08538","snapshot_observed_at":"2026-07-04T08:09:41.063430Z","title":"Aleksandar Petrov, Emanuele La Malfa, Philip Torr, and Adel Bibi","venue":null,"work_id":"8ad2c179-4df5-4414-a758-3085bc944bad","year":2023},"citing_paper":{"arxiv_id":"2606.07020","last_updated":"2026-06-05T08:09:46Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T08:09:46Z","title":"MADE: Beyond Scoring via a Multilingual Agentic Diagnosing Engine for Fine-Grained Evaluation Insights","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-06-27T22:16:42.836058Z"},"links":{"cited_paper":"/paper/2507.08538","citing_paper":"/paper/2606.07020"},"observation_digest":"sha256:4f403a05dd6c0ce52aa3a5f4311d26a150c995ba88ca83beb6ff67dde26c8933","observation_id":"d6b8e740-e173-4c1f-be05-b7e98a48b732","resolution":{"observed_at":"2026-07-02T16:57:09.878647Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"cited_work":{"arxiv_id":"2507.08538","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.08538","snapshot_observed_at":"2026-07-04T08:09:41.063430Z","title":"Aleksandar Petrov, Emanuele La Malfa, Philip Torr, and Adel Bibi","venue":null,"work_id":"8ad2c179-4df5-4414-a758-3085bc944bad","year":2023},"citing_paper":{"arxiv_id":"2606.21869","last_updated":"2026-06-20T04:12:29Z","snapshot_observed_at":"2026-08-07T01:52:47.874310Z","submitted_at":"2026-06-20T04:12:29Z","title":"The Language-Energy Divide: Measuring Energy Costs of Multilingual LLM Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T12:12:45.853559Z"},"links":{"cited_paper":"/paper/2507.08538","citing_paper":"/paper/2606.21869"},"observation_digest":"sha256:5ed8c97f33f7731dd603ab7d058721ab2babb1dcea2fd9f2d6d360791ba582ce","observation_id":"fe845ad2-462c-4b79-9366-31d37fc2fe62","resolution":{"observed_at":"2026-07-04T08:09:41.065578Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.08538/citation-record","integrity":"/paper/2507.08538/integrity","json":"/paper/2507.08538/citation-record.json","paper":"/paper/2507.08538"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:20:00.110456Z","title":null,"venue":null,"work_id":"a2f9685f-7d87-47e5-87f2-0e80cf051fc8","year":2022},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.286503Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:02ac9881cbafb06505c74b7acd7629c2eaa89c50262f62de71f200cde62d141e","observation_id":"ea5dc9a5-023e-4979-9cef-feceaabe33a4","resolution":{"observed_at":"2026-08-06T18:20:00.116357Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07445","last_updated":"2024-03-07T13:16:08Z","snapshot_observed_at":"2026-07-06T16:18:17.458740Z","submitted_at":"2023-09-14T05:56:49Z","title":"SIB-200: A Simple, Inclusive, and Big Evaluation Dataset for Topic Classification in 200+ Languages and Dialects","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07445","snapshot_observed_at":"2026-08-06T18:19:59.297703Z","title":"Alabi, Yanke Mao, Haonan Gao, and Annie En-Shiun Lee","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.297703Z"},"links":{"cited_paper":"/paper/2309.07445","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:64cc8c6c7c1b987a83e544f21fa551c4766eef8ee109b577500103a535191f6a","observation_id":"a3f2fbe0-9388-49c3-8b8f-62c6a6591335","resolution":{"observed_at":"2026-08-06T18:19:59.297703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03368","last_updated":"2025-01-23T17:57:28Z","snapshot_observed_at":"2026-08-04T04:08:21.311509Z","submitted_at":"2024-06-05T15:23:08Z","title":"IrokoBench: A New Benchmark for African Languages in the Age of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03368","snapshot_observed_at":"2026-08-06T18:19:59.301933Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.301933Z"},"links":{"cited_paper":"/paper/2406.03368","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:e6ce6d51af3c40f0cfcebb88d696b031f83daa32daed8194b0e2d8eb7c52a35b","observation_id":"74157662-1675-4467-8bcc-c0cddf292b77","resolution":{"observed_at":"2026-08-06T18:19:59.301933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.313039Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.313039Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:2d1cbc61db5430d97fb70d021289af5d9de879678a0070e4504cde103f878541","observation_id":"c5d39465-3f03-4cb6-9ff7-818308f676a7","resolution":{"observed_at":"2026-08-06T18:19:59.313039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.316902Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.316902Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:414359225051ece9d4398f54c36842c3092a3c626c2634dd7d6c82a38497261d","observation_id":"73d888ff-7b96-4575-bfc2-f15485c3c338","resolution":{"observed_at":"2026-08-06T18:19:59.316902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:20:00.099529Z","title":null,"venue":null,"work_id":"0412bd4a-bcd4-49c8-a981-51c272ae01f4","year":2018},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.320491Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:eccb4bf196f02227ee703a96c3114fc6ef24764184d16cad674286f501e353ec","observation_id":"12900b22-1ea5-432d-9e9a-7d5c63184090","resolution":{"observed_at":"2026-08-06T18:20:00.103872Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.324622Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.324622Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:25913d5dc3d94c15c910cb086518254bc0937d9deb2d09bc330f53feef16855a","observation_id":"f50d2a13-f26b-4a51-ab1f-a6eab9fb5177","resolution":{"observed_at":"2026-08-06T18:19:59.324622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00948","last_updated":"2024-12-01T19:46:40Z","snapshot_observed_at":"2026-07-06T19:59:47.022132Z","submitted_at":"2024-12-01T19:46:40Z","title":"Uhura: A Benchmark for Evaluating Scientific Question Answering and Truthfulness in Low-Resource African Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00948","snapshot_observed_at":"2026-08-06T18:19:59.327369Z","title":"Alabi, Jonas Kgomo, Tyna Eloundou, Elizabeth Proehl, Kai Chen, Imaan Khadir, Naome A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.327369Z"},"links":{"cited_paper":"/paper/2412.00948","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:efb5429ccec5999d8b2bda6d8d4c78d3e3476c1f26d561591cb066e76aaca5d5","observation_id":"9495b29a-229b-43fe-b043-f51a8d8d39c5","resolution":{"observed_at":"2026-08-06T18:19:59.327369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.331114Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.331114Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:e0bdafb41ae2b0e3ef5c09a6a6d6f7ff4798b22f9fc46e6da2411c2d2e8b0f6c","observation_id":"b13a21ec-78e8-4094-977a-93b2acdc80f9","resolution":{"observed_at":"2026-08-06T18:19:59.331114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-06T18:19:59.345260Z","title":"https://doi.org/10.48550/arXiv.1803.05457 Think you have Solved Question Answering ? Try ARC , the AI2 Reasoning Challenge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.345260Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:9e99219e58e6c558da2abd70c429b94b726eb8283877169d6fb3f91751d02502","observation_id":"316ba190-ca4d-4be0-804d-3cb9a2a4f783","resolution":{"observed_at":"2026-08-06T18:19:59.345260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-06T18:19:59.348657Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.348657Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:fe3e60daf73a0215a07ce28ff57966ac9539db931cbf49063d28a3ba0702e364","observation_id":"2dadaf57-a4d2-4e71-9310-6510fe1dfcf5","resolution":{"observed_at":"2026-08-06T18:19:59.348657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T18:19:59.352217Z","title":"https://doi.org/10.48550/arXiv.2110.14168 Training Verifiers to Solve Math Word Problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.352217Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:149ef5a73132151a132b94ceec1cc158b164adb8c91bb0106cbeb038b9d78205","observation_id":"2ccd1855-5476-4a80-a4e0-891fa333c7cc","resolution":{"observed_at":"2026-08-06T18:19:59.352217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T18:19:59.358937Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.358937Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:a04ae7c67b064f145868b1d9c6f8e30468222be3519302a1465224763f4b7663","observation_id":"40d3f81d-f183-46b7-9f57-013f7a0f15e9","resolution":{"observed_at":"2026-08-06T18:19:59.358937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.362269Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.362269Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:0957bd4ff40bc3adce3ae33bc64f70fcfb335fe456686a81695df0d4b9deb5b9","observation_id":"5b815c6d-6f48-449e-a8d6-69bbf1ee79f4","resolution":{"observed_at":"2026-08-06T18:19:59.362269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.370724Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.370724Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:b29b5b3b0cc9bddae2eccaa07b99c08019671a70aa9611e01126bc4b72155992","observation_id":"68de6cc5-cffb-4362-b86b-306e8654b6e7","resolution":{"observed_at":"2026-08-06T18:19:59.370724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.373566Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.373566Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:4aef1018edec3f42d7c546ba56a26c8ec436cb52998ddd0d25aa0df1eeecc864","observation_id":"a3ebffed-3383-44b8-b7c6-1c8850839acb","resolution":{"observed_at":"2026-08-06T18:19:59.373566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.376093Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.376093Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:477122349fd5a825c8ca482bb7b722a42ec6a6f17a650b5c047a3a0d231a3ac6","observation_id":"40f01db5-8738-4e51-a15a-31e2aabac34a","resolution":{"observed_at":"2026-08-06T18:19:59.376093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:20:00.076994Z","title":"Eberhard, Gary F","venue":null,"work_id":"b8e74dde-334a-467c-b84d-5fb81e7de02d","year":2025},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.380102Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:c877f2d74c019213f02f58948b76e0ac0acece4722b320f607abc9d4b2a70535","observation_id":"2d44566c-ee72-4965-bd9b-62fbb6cefabf","resolution":{"observed_at":"2026-08-06T18:20:00.084843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:20:00.061110Z","title":null,"venue":null,"work_id":"a65a061c-9454-468e-99d1-0051e491fd63","year":2020},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.387423Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:a7aa33ed8e2060855c3bcfb2b7a08c3c208681087c34d40b64dee5fb3b663cc1","observation_id":"371f5463-c200-41bf-a438-ba27692daa18","resolution":{"observed_at":"2026-08-06T18:20:00.065614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.emnlp-main.674","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.590452Z","title":null,"venue":null,"work_id":"f4e13376-f546-44b1-a077-a5198c7eb9ca","year":2022},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.397423Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:39fda117e1dd8d8aac556ef01ca333e278c32f07121c56c41e7fa415a829bca8","observation_id":"7fa8c939-2e20-4dbd-a464-da82de0f37d9","resolution":{"observed_at":"2026-08-06T18:19:59.597764Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.401528Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.401528Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:f03268cb81b600be38e12d09ecd9415aa43cb32d24ff7365c67aa6de4816179c","observation_id":"1d22288d-4ec5-4ebf-8937-6ec2001dda73","resolution":{"observed_at":"2026-08-06T18:19:59.401528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.404568Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.404568Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:e80762031da1f9cf1fd64f7b117094056a4a0c40c9e5b786be68043ec44bf52a","observation_id":"d646cb52-a33e-4b21-9279-fee469173916","resolution":{"observed_at":"2026-08-06T18:19:59.404568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T18:19:59.420042Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.420042Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:054a9b541ae21adf6acae5ff83a98a222f14a3268f4bb4c752edcfeb10bd08d0","observation_id":"2abf76eb-59de-4ed3-b413-675fdb541f32","resolution":{"observed_at":"2026-08-06T18:19:59.420042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-naacl.67","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.567107Z","title":null,"venue":null,"work_id":"a90c103a-ac5f-4c33-ac17-3ddc4732f2c8","year":2025},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.422684Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:f1b8b5ab0b496878ae10192d5c12ec3efbf0df5aaa116c290a7246afe6282c9a","observation_id":"2a3720dd-1d5f-4fa7-a27b-a521650b0d69","resolution":{"observed_at":"2026-08-06T18:19:59.572001Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-06T18:19:59.425715Z","title":"https://doi.org/10.48550/arXiv.2009.03300 Measuring Massive Multitask Language Understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.425715Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:3a95bcc7584fa5bb859d5bad232a1283083d76d571397bf3ca0b44ab897c17a0","observation_id":"3f6dd766-7819-4598-9c5c-3e5fee4c167e","resolution":{"observed_at":"2026-08-06T18:19:59.425715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-06T18:19:59.429610Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.429610Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:41544eb62edc7003b5bce272bf6fbf277d4540f9ffa334ad763e01132b9c276e","observation_id":"b0ccd95b-80db-4b7d-ae55-6aa4eaa3fd47","resolution":{"observed_at":"2026-08-06T18:19:59.429610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16039","last_updated":"2023-08-02T00:39:25Z","snapshot_observed_at":"2026-08-04T18:29:36.809656Z","submitted_at":"2023-07-29T18:01:46Z","title":"Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16039","snapshot_observed_at":"2026-08-06T18:19:59.432414Z","title":"Rossi, and Thien Huu Nguyen","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.432414Z"},"links":{"cited_paper":"/paper/2307.16039","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:0e5067e397fd9b146154b20581ae7dec2e05f77ec36a01281e080b23f681013d","observation_id":"9f4be4c7-7d94-47bf-b8bf-a289c9cc45c2","resolution":{"observed_at":"2026-08-06T18:19:59.432414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.435453Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.435453Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:6a0ab1a80414bb6763289d634ba03417e93704932db13756e7437189ad389fcd","observation_id":"6abaf680-c7f8-44c5-9d50-82fecfaff93b","resolution":{"observed_at":"2026-08-06T18:19:59.435453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:20:00.039582Z","title":null,"venue":null,"work_id":"3b19aeba-aaf1-4bca-b31a-ffda5c099a87","year":2014},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.438133Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:b940e5b97b32b9b6c5013349f1f586741c66b37a8687863b373905e1b5a7f019","observation_id":"edc97634-f5c4-44aa-b52d-5005161a89a1","resolution":{"observed_at":"2026-08-06T18:20:00.049239Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07978","last_updated":"2025-06-07T11:23:49Z","snapshot_observed_at":"2026-07-06T16:47:12.709738Z","submitted_at":"2023-11-14T08:10:14Z","title":"AfroBench: How Good are Large Language Models on African Languages?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07978","snapshot_observed_at":"2026-08-06T18:19:59.443625Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.443625Z"},"links":{"cited_paper":"/paper/2311.07978","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:9e09616bf92aa536d26f62c4efb49259210ad57123d3f422e9f2c093ea9725fd","observation_id":"f2fa17cc-eb8c-4d46-b7b0-47104a8c9d1c","resolution":{"observed_at":"2026-08-06T18:19:59.443625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.446447Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.446447Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:2571c3129235ebadd1c43eb58b8bc9e2a1231178ac9b9372b8e2c4e73dc43814","observation_id":"0d0cf63a-55ed-4e2c-a021-74a74d668996","resolution":{"observed_at":"2026-08-06T18:19:59.446447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:20:00.027100Z","title":null,"venue":null,"work_id":"84f2742f-cc96-4b01-80c0-41379f88c121","year":2020},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.449243Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:02f642da51571c2d615bb3aa93dd48f8aa050f92c5a15050a86d51fb81fcad70","observation_id":"09b840e1-b651-4402-bccc-354a17892cfa","resolution":{"observed_at":"2026-08-06T18:20:00.031481Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:20:00.013188Z","title":null,"venue":null,"work_id":"6d72c058-4486-4d58-9d78-6b79b50c5d9e","year":2025},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.451844Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:69a990813806618b3e3f539648f3fc0a3a053f35bc5aa1cbad19f8df13ba81a2","observation_id":"ea9e2e71-2600-448a-b84c-7cbb86697667","resolution":{"observed_at":"2026-08-06T18:20:00.018207Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.454603Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.454603Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:d8f22c62c869d5d7b17d60e54e317c4210b42341a5ed2ab3707cca60971eeabe","observation_id":"ec21d80d-d331-42aa-8f16-d7cbebd7a210","resolution":{"observed_at":"2026-08-06T18:19:59.454603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.986899Z","title":null,"venue":null,"work_id":"4849d359-8e03-4492-bba2-8c959a3f02a4","year":2021},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.457204Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:f054e4831c7e15212eb472d1bbafa379b6d6def67d2fe0877d6a95378e2f95d7","observation_id":"2fa77bbf-7f2e-4af4-9480-bbf1bc74644e","resolution":{"observed_at":"2026-08-06T18:20:00.000793Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03057","last_updated":"2022-10-06T17:03:34Z","snapshot_observed_at":"2026-07-06T14:00:37.875054Z","submitted_at":"2022-10-06T17:03:34Z","title":"Language Models are Multilingual Chain-of-Thought Reasoners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03057","snapshot_observed_at":"2026-08-06T18:19:59.459779Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.459779Z"},"links":{"cited_paper":"/paper/2210.03057","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:8ebab2987b45f8eab6f11ec8543bebf7a08cbdbd645b0bd4eb41c39e2e7fc854","observation_id":"f4dbf787-c595-4360-92b2-1435ec378768","resolution":{"observed_at":"2026-08-06T18:19:59.459779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-08-06T18:19:59.462845Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.462845Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:1b109df8320a44bc9ea01e2c57c85e358a360cb4ca3037a9c1478215853c4e86","observation_id":"75c7a333-5511-4883-9966-214c158b7954","resolution":{"observed_at":"2026-08-06T18:19:59.462845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-06T18:19:59.466179Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.466179Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:f2f886614f8a7cdb86bcc1334c0f2e978ef26d652d8008c3175903b94e4cc994","observation_id":"c39204d1-abe3-4fc3-a480-15c1b4b0e12c","resolution":{"observed_at":"2026-08-06T18:19:59.466179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08928","last_updated":"2024-10-17T17:58:53Z","snapshot_observed_at":"2026-07-06T19:31:53.397265Z","submitted_at":"2024-10-11T15:53:24Z","title":"Towards Multilingual LLM Evaluation for European Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08928","snapshot_observed_at":"2026-08-06T18:19:59.469267Z","title":"o hler, Ren \\'e J \\","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.469267Z"},"links":{"cited_paper":"/paper/2410.08928","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:0b2296a3593372deaf784371453a4c3b0d4b704bc40299ece6b8573232483bd2","observation_id":"9e9bfe70-e9d4-449f-82b4-ed9ee62f7b75","resolution":{"observed_at":"2026-08-06T18:19:59.469267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08928","last_updated":"2024-10-17T17:58:53Z","snapshot_observed_at":"2026-07-06T19:31:53.397265Z","submitted_at":"2024-10-11T15:53:24Z","title":"Towards Multilingual LLM Evaluation for European Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08928","snapshot_observed_at":"2026-08-06T18:19:59.472849Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.472849Z"},"links":{"cited_paper":"/paper/2410.08928","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:1c2b29545258455bf8d298e3ebb715bd0a54d27ffcd9e2829b903bae09b4e03e","observation_id":"b138c725-3ee2-4ae8-94b3-f9fa36f6f61f","resolution":{"observed_at":"2026-08-06T18:19:59.472849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.475927Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.475927Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:589b838d5c740f01dbf37c5aea1bcc4f39ee1d2085265f6de6875fdd4371fba3","observation_id":"492a34b0-5344-4c66-b1ad-0411e78bc728","resolution":{"observed_at":"2026-08-06T18:19:59.475927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.478444Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.478444Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:a1b0dbfe3604349bd9b42b7f31f370b917eed766a2a7b4a1ecc9e00872f76319","observation_id":"47f9d69e-db9d-46d3-8415-ca814bdfb838","resolution":{"observed_at":"2026-08-06T18:19:59.478444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-06T18:19:59.481633Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.481633Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:c1eec428ea45ebb91802c685fdb15af27d567798c91d143fefa3fd2c09930ebe","observation_id":"92444df7-09a0-46c4-bbfb-5e41e53ca32a","resolution":{"observed_at":"2026-08-06T18:19:59.481633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.484979Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.484979Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:b72c727105994b6f1bb93a67b70df33c813522fb947af316cbc653499affb1e9","observation_id":"a693c908-41b3-4107-baa7-f147dc88334d","resolution":{"observed_at":"2026-08-06T18:19:59.484979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.488074Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.488074Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:08ed47ed50f98731f0d07e0905bb3ec38810dd875eb5d981d4b60882054d6ed5","observation_id":"15b845e3-1c0e-4bc5-a390-2e997e86499a","resolution":{"observed_at":"2026-08-06T18:19:59.488074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T18:14:12.269124Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":2,"verified_fuzzy":1},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 2 inbound Pith citation observations for arXiv:2507.08538."}