{"as_of":"2026-08-07T23:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b5803771112b4197e40b342a24ad23db3a731c7cfd850e77b156548853873206","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:35:33.032518Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.24635/citation-record","integrity":"/paper/2505.24635/integrity","json":"/paper/2505.24635/citation-record.json","paper":"/paper/2505.24635"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:30.310743Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.310743Z"},"links":{"citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:88c8cb006004307a9508b6304a9ea8a2de347df20138ada724fb48298e45bb28","observation_id":"b584db00-d352-45d2-8f3e-d42e8cb31f84","resolution":{"observed_at":"2026-08-07T12:35:30.310743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18838","last_updated":"2025-04-26T07:48:52Z","snapshot_observed_at":"2026-08-07T15:59:01.524786Z","submitted_at":"2025-04-26T07:48:52Z","title":"Toward Generalizable Evaluation in the LLM Era: A Survey Beyond Benchmarks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18838","snapshot_observed_at":"2026-08-07T12:35:30.383031Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.383031Z"},"links":{"cited_paper":"/paper/2504.18838","citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:c2f717f98a23ac197743af3bdcf1d8b0c73b411da14ae4bd961e2987fef1683c","observation_id":"fe36fe63-bf95-4b02-aba1-fe168ef7da96","resolution":{"observed_at":"2026-08-07T12:35:30.383031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07440","last_updated":"2025-05-26T11:07:21Z","snapshot_observed_at":"2026-08-07T16:06:59.426574Z","submitted_at":"2025-04-10T04:09:47Z","title":"Model Utility Law: Evaluating LLMs beyond Performance through Mechanism Interpretable Metric","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07440","snapshot_observed_at":"2026-08-07T12:35:30.450813Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.450813Z"},"links":{"cited_paper":"/paper/2504.07440","citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:0b212d88b8c7ade254f1c6cff4e37f449b54c9ef9c2aba5bb4d4c5557e93d53f","observation_id":"545853b1-e495-4d69-a88b-671cfb2c1227","resolution":{"observed_at":"2026-08-07T12:35:30.450813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02677","last_updated":"2025-06-03T01:56:26Z","snapshot_observed_at":"2026-08-06T03:16:16.590345Z","submitted_at":"2024-10-03T17:04:31Z","title":"CulturalBench: A Robust, Diverse, and Challenging Cultural Benchmark by Human-AI CulturalTeaming","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02677","snapshot_observed_at":"2026-08-07T12:35:30.577676Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.577676Z"},"links":{"cited_paper":"/paper/2410.02677","citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:65605fb3f6e97a47a4faea8a2aea35c3f721319b4553d50c341f2c6af336e528","observation_id":"d6e1a612-e347-49a3-b5e8-66b55159d98f","resolution":{"observed_at":"2026-08-07T12:35:30.577676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T12:35:30.670996Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.670996Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:47ecc4c165b956b7168e58a0c6d6d434270e840eb1be599dfbc81b174e9150b0","observation_id":"0f093d86-4add-44d5-b7bc-6130c22afe9c","resolution":{"observed_at":"2026-08-07T12:35:30.670996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:34.222422Z","title":null,"venue":null,"work_id":"7f3810bc-bba7-47a2-9b8d-702085c3b470","year":2024},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.786039Z"},"links":{"citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:f08b751c9a03e441dd49379a10ebc1d4737ee1348146e9da05faedd5192c1bee","observation_id":"e5a57296-a27f-417e-84a0-0d78ab4a73cf","resolution":{"observed_at":"2026-08-07T12:35:34.318376Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:30.868536Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.868536Z"},"links":{"citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:ad9fbd34a2b2e7972884410930ab63d0202c1538d967d8e791267ad6a9aa8d7e","observation_id":"ab413b52-840a-4d12-bef7-4b465ede556a","resolution":{"observed_at":"2026-08-07T12:35:30.868536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T12:35:30.975371Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.975371Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:9bf1804d6fdf730e7acdb23178d7c46b405cacd8b96328502c18c958f7e2b5a6","observation_id":"97426cd6-c677-4952-b9da-1efedfbd4f00","resolution":{"observed_at":"2026-08-07T12:35:30.975371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:31.063098Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.063098Z"},"links":{"citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:4b9fcf00e7e9b22bee954b92c300c10429fbdaec66c65f391abf2686c46a2a6e","observation_id":"5cc99fa0-6ce5-4cf3-bf32-eaa45ada50ad","resolution":{"observed_at":"2026-08-07T12:35:31.063098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11614","last_updated":"2025-09-01T18:50:34Z","snapshot_observed_at":"2026-07-06T18:32:15.404516Z","submitted_at":"2024-06-17T15:00:35Z","title":"Intrinsic Test of Unlearning Using Parametric Knowledge Traces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11614","snapshot_observed_at":"2026-08-07T12:35:31.131951Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.131951Z"},"links":{"cited_paper":"/paper/2406.11614","citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:6c735ebfa0b99615169297fc86577e7b350ea7c370eef950d96fac04337ba003","observation_id":"4c34f7a2-6192-4306-b09f-bd0a425a6909","resolution":{"observed_at":"2026-08-07T12:35:31.131951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:34.009867Z","title":null,"venue":null,"work_id":"e009cd74-283e-4469-92be-7afdceebc667","year":2024},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.215879Z"},"links":{"citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:fbc2bca12591d8f8fdbe692ae4a89b343423d7dc6922beaf017ae13d4f2738b0","observation_id":"a4467368-c0c4-45b9-9801-02a593adf7b1","resolution":{"observed_at":"2026-08-07T12:35:34.087343Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06085","last_updated":"2023-09-19T03:44:17Z","snapshot_observed_at":"2026-07-06T16:17:23.229347Z","submitted_at":"2023-09-12T09:31:25Z","title":"BHASA: A Holistic Southeast Asian Linguistic and Cultural Evaluation Suite for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06085","snapshot_observed_at":"2026-08-07T12:35:31.299955Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.299955Z"},"links":{"cited_paper":"/paper/2309.06085","citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:4de0cd68026b3b48149cc334c30ba6173ae714f1e7c7b0d118470c2041c1b45e","observation_id":"a11b7aff-1b05-483f-b640-8515b7c6c8e7","resolution":{"observed_at":"2026-08-07T12:35:31.299955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06298","last_updated":"2025-02-10T09:40:25Z","snapshot_observed_at":"2026-08-02T11:08:25.637585Z","submitted_at":"2025-02-10T09:40:25Z","title":"SeaExam and SeaBench: Benchmarking LLMs with Local Multilingual Questions in Southeast Asia","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06298","snapshot_observed_at":"2026-08-07T12:35:31.361951Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.361951Z"},"links":{"cited_paper":"/paper/2502.06298","citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:504d7141b88aa1ae56b976be218af825f5e301633be49eb3b503db9890421511","observation_id":"db639b68-38c1-4584-87dd-41e5125fb336","resolution":{"observed_at":"2026-08-07T12:35:31.361951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01786","last_updated":"2023-05-29T16:40:37Z","snapshot_observed_at":"2026-08-06T03:54:27.439090Z","submitted_at":"2022-11-03T13:19:32Z","title":"Crosslingual Generalization through Multitask Finetuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01786","snapshot_observed_at":"2026-08-07T12:35:31.446833Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.446833Z"},"links":{"cited_paper":"/paper/2211.01786","citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:a00c800aae5cfc7b5148455aba14506ae2f64d0eb5331848f6df800d5c264fa1","observation_id":"417313c1-cc50-42f6-b690-1c93f4b9ea54","resolution":{"observed_at":"2026-08-07T12:35:31.446833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:33.867780Z","title":null,"venue":null,"work_id":"b15c884b-3e83-4419-9346-c7c4bceda0d3","year":2024},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.544759Z"},"links":{"citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:055a45f893969263174b4cd99cd1380b535af9d039556e162122b6778aa2fc41","observation_id":"7a09cff2-1343-4168-b394-1863624cde60","resolution":{"observed_at":"2026-08-07T12:35:33.937127Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:31.621695Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.621695Z"},"links":{"citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:9f90006e21bf046b9548cc753c57629fa56aac0ba56e6a9075fe281d74ac1bf7","observation_id":"b6627754-7a28-409a-a819-fe97787bc1b0","resolution":{"observed_at":"2026-08-07T12:35:31.621695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:33.699115Z","title":null,"venue":null,"work_id":"f0ef69f9-ea45-40b3-9110-5ef5fbf26ee0","year":2024},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.672619Z"},"links":{"citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:0ae20b6e0a7c269af83668e53076bb4521d7c390b4707d94fb47ad07578da4ce","observation_id":"5e829491-d525-4fe6-9ff4-02dc8b388965","resolution":{"observed_at":"2026-08-07T12:35:33.784466Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T12:35:31.753236Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.753236Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:347807e79ac5daa158087a637426c96cfd1d9243224c3d32ab7b91527e9039e1","observation_id":"0d910d80-1073-4ae0-a48c-5777ee2eb970","resolution":{"observed_at":"2026-08-07T12:35:31.753236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T12:35:31.893975Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.893975Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:289349e09a10397fd5239d7c5960bc8bbdaa4486e97a565e2967214911c1ad92","observation_id":"274dd890-6f2b-4fe5-abfa-88d2fc3bf5c4","resolution":{"observed_at":"2026-08-07T12:35:31.893975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03057","last_updated":"2022-10-06T17:03:34Z","snapshot_observed_at":"2026-07-06T14:00:37.875054Z","submitted_at":"2022-10-06T17:03:34Z","title":"Language Models are Multilingual Chain-of-Thought Reasoners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03057","snapshot_observed_at":"2026-08-07T12:35:32.015576Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.015576Z"},"links":{"cited_paper":"/paper/2210.03057","citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:b39df08f2ea6d1bdce16d8e9f48bd1971df3dcc13ecdefbd9a7307ee3b90c34c","observation_id":"1740e2e0-9e3d-4055-8641-d8456358748a","resolution":{"observed_at":"2026-08-07T12:35:32.015576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16438","last_updated":"2024-06-06T08:14:46Z","snapshot_observed_at":"2026-07-06T17:35:23.161066Z","submitted_at":"2024-02-26T09:36:05Z","title":"Language-Specific Neurons: The Key to Multilingual Capabilities in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16438","snapshot_observed_at":"2026-08-07T12:35:32.258791Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.258791Z"},"links":{"cited_paper":"/paper/2402.16438","citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:96707f9e8766e4cc8ec4ec6cbcab708f19a7127aa1f7a37490225ab88f9835fe","observation_id":"3e978c99-7ad8-4c14-b83a-5dc943c536eb","resolution":{"observed_at":"2026-08-07T12:35:32.258791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-07T12:35:32.331555Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.331555Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:f726af21d84c58019ca422fd9868061715ad4c4e9de58f135b3fd081709e48ac","observation_id":"9e974ea5-6772-40b4-af04-873cf1c17ffc","resolution":{"observed_at":"2026-08-07T12:35:32.331555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:33.523993Z","title":null,"venue":null,"work_id":"fce57ba3-0bcb-4f5a-8f18-c7d4ba587374","year":2024},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.434992Z"},"links":{"citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:08c567a90fb2fed4e48af0f5ca53aefed12b72d4cb1720854ba17a24106c1f4e","observation_id":"248d82b0-cc93-41e4-b373-26ab7dfe7199","resolution":{"observed_at":"2026-08-07T12:35:33.597931Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:32.530994Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.530994Z"},"links":{"citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:3a6cc666f48d57f683eb0ea805a10f1b77b9caaded5410696a7b44ee167dbb67","observation_id":"34fba750-ab18-4cf6-8e74-9eccf946f6b6","resolution":{"observed_at":"2026-08-07T12:35:32.530994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10588","last_updated":"2024-06-08T11:15:14Z","snapshot_observed_at":"2026-07-06T17:31:04.675896Z","submitted_at":"2024-02-16T11:21:28Z","title":"Do Llamas Work in English? On the Latent Language of Multilingual Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10588","snapshot_observed_at":"2026-08-07T12:35:32.626946Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.626946Z"},"links":{"cited_paper":"/paper/2402.10588","citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:15f4166cae23ac118ab747857ea3de9744604aa045a1074a7dd76513e58ee2ab","observation_id":"2d4d9e63-387f-4f55-9ef2-9ed1152d6fc5","resolution":{"observed_at":"2026-08-07T12:35:32.626946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:32.733838Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.733838Z"},"links":{"citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:839fb58995561e9255c304d566161b9cd93b5af1666e2b6d2fbd575742c3126c","observation_id":"eb7bcc25-5d00-407a-95a0-8b0f2b563f27","resolution":{"observed_at":"2026-08-07T12:35:32.733838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:33.404268Z","title":null,"venue":null,"work_id":"ecb15ac0-f372-4c44-9ff1-065174bf7a60","year":2023},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.804553Z"},"links":{"citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:0888a0225c8af095468885e1bd3f88bbe5324144276bb53814100eb6828e3bff","observation_id":"5dd1b83d-7f22-4f67-b534-26abce526a3c","resolution":{"observed_at":"2026-08-07T12:35:33.452076Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19672","last_updated":"2024-07-29T03:26:22Z","snapshot_observed_at":"2026-07-06T18:53:05.207665Z","submitted_at":"2024-07-29T03:26:22Z","title":"SeaLLMs 3: Open Foundation and Chat Multilingual Large Language Models for Southeast Asian Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19672","snapshot_observed_at":"2026-08-07T12:35:32.877616Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.877616Z"},"links":{"cited_paper":"/paper/2407.19672","citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:0df529457e50f2fe3a8323799a366a28abf235efc818aec6d248605f097e9528","observation_id":"6e5cdfa0-728f-4af4-bc80-471c884a1b90","resolution":{"observed_at":"2026-08-07T12:35:32.877616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18815","last_updated":"2024-11-10T12:49:15Z","snapshot_observed_at":"2026-07-06T17:37:09.952632Z","submitted_at":"2024-02-29T02:55:26Z","title":"How do Large Language Models Handle Multilingualism?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18815","snapshot_observed_at":"2026-08-07T12:35:32.951876Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.951876Z"},"links":{"cited_paper":"/paper/2402.18815","citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:e405e396c91ef2e05f998425f2a336792ab8d14671c3af9def2760e9b9d982ea","observation_id":"11197da8-c143-4207-adcd-a3ab214724d4","resolution":{"observed_at":"2026-08-07T12:35:32.951876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-07T12:35:33.032518Z","title":"P Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.032518Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2505.24635"},"observation_digest":"sha256:343e73f42fa9570f98bdd462b31b9befb2d2ef00d8a46c34bd467f1c2374fb81","observation_id":"ae484c60-081a-429b-bece-63d9e534e71d","resolution":{"observed_at":"2026-08-07T12:35:33.032518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.24635","last_updated":"2025-05-30T14:25:45Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T12:14:11.365110Z","submitted_at":"2025-05-30T14:25:45Z","title":"Disentangling Language and Culture for Evaluating Multilingual Large Language Models"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2505.24635."}