{"as_of":"2026-08-13T14:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:308aaa67207a103507ab0a589d2f40999fa2b5bc38ac1358119191822ba8ed76","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T21:10:35.206608Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.04947/citation-record","integrity":"/paper/2412.04947/integrity","json":"/paper/2412.04947/citation-record.json","paper":"/paper/2412.04947"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:10:35.391410Z","title":"In each cluster, theses whose cosine similarities to the centroid are of the lowest 25% portion are treated as outliers and discarded","venue":null,"work_id":"4ade16e5-7024-49b4-b0b4-c8fb5c2fefae","year":2017},"citing_paper":{"arxiv_id":"2412.04947","last_updated":"2025-05-29T05:29:28Z","snapshot_observed_at":"2026-08-12T01:40:30.259470Z","submitted_at":"2024-12-06T11:07:44Z","title":"C$^2$LEVA: Toward Comprehensive and Contamination-Free Language Model Evaluation","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T21:10:35.201908Z"},"links":{"citing_paper":"/paper/2412.04947"},"observation_digest":"sha256:8c24f6638b7dfaae17ca45fce304fd67c348ea0534f2ee96ed0e3da0e4e6d190","observation_id":"e0091dda-622f-423b-ae42-971192950213","resolution":{"observed_at":"2026-08-11T21:10:35.396572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:10:35.374940Z","title":"The claim sug- gests","venue":null,"work_id":"277abb66-2993-411f-bf7c-4a89ef4b735e","year":2022},"citing_paper":{"arxiv_id":"2412.04947","last_updated":"2025-05-29T05:29:28Z","snapshot_observed_at":"2026-08-12T01:40:30.259470Z","submitted_at":"2024-12-06T11:07:44Z","title":"C$^2$LEVA: Toward Comprehensive and Contamination-Free Language Model Evaluation","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T21:10:35.206608Z"},"links":{"citing_paper":"/paper/2412.04947"},"observation_digest":"sha256:4747243a5d70d27c083388245e918c949a3b576ac7248929b56fd4aa81ded552","observation_id":"b0dbb717-65da-408e-9b53-0320ac9165c8","resolution":{"observed_at":"2026-08-11T21:10:35.380151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:10:35.407661Z","title":"open”) or has limited-access via APIs (“limited","venue":null,"work_id":"68391cc8-e13a-430b-be9f-7bd8530e6f5f","year":2023},"citing_paper":{"arxiv_id":"2412.04947","last_updated":"2025-05-29T05:29:28Z","snapshot_observed_at":"2026-08-12T01:40:30.259470Z","submitted_at":"2024-12-06T11:07:44Z","title":"C$^2$LEVA: Toward Comprehensive and Contamination-Free Language Model Evaluation","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T21:10:35.195604Z"},"links":{"citing_paper":"/paper/2412.04947"},"observation_digest":"sha256:49948e07299ad7a70581d641cf15d25c6efa6184e34832fab8ffb9b97aeee92f","observation_id":"deec27e6-730f-483b-b391-45c441c18323","resolution":{"observed_at":"2026-08-11T21:10:35.412977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:10:35.439277Z","title":"In Findings of the Association for Computational Lin- guistics: EMNLP 2024, pages 16131–16161, Miami, Florida, USA","venue":null,"work_id":"831b9e2c-e5d8-481a-8000-3d6b88508152","year":2024},"citing_paper":{"arxiv_id":"2412.04947","last_updated":"2025-05-29T05:29:28Z","snapshot_observed_at":"2026-08-12T01:40:30.259470Z","submitted_at":"2024-12-06T11:07:44Z","title":"C$^2$LEVA: Toward Comprehensive and Contamination-Free Language Model Evaluation","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T21:10:35.163126Z"},"links":{"citing_paper":"/paper/2412.04947"},"observation_digest":"sha256:eae7ce5217bee5d11b7321ea6d1938716bed2977dcfc0cb7f0ea12f693a9e1b4","observation_id":"15db959a-ffac-440c-8742-ea735da89260","resolution":{"observed_at":"2026-08-11T21:10:35.444309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-11T21:10:35.168947Z","title":"Freda Shi, Xinyun Chen, Kanishka Misra, Nathan Scales, David Dohan, Ed H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04947","last_updated":"2025-05-29T05:29:28Z","snapshot_observed_at":"2026-08-12T01:40:30.259470Z","submitted_at":"2024-12-06T11:07:44Z","title":"C$^2$LEVA: Toward Comprehensive and Contamination-Free Language Model Evaluation","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T21:10:35.168947Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2412.04947"},"observation_digest":"sha256:5aa602c14acb0175f3520079bbcbfb4472ed0784d10d0a1de94a0073d00d8ef8","observation_id":"5b6a7181-7faa-4e0f-b52b-09b32b0c7536","resolution":{"observed_at":"2026-08-11T21:10:35.168947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-07T13:56:34.167869Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-11T21:10:35.180127Z","title":"Weichao Zhang, Ruqing Zhang, Jiafeng Guo, Maarten de Rijke, Yixing Fan, and Xueqi Cheng","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04947","last_updated":"2025-05-29T05:29:28Z","snapshot_observed_at":"2026-08-12T01:40:30.259470Z","submitted_at":"2024-12-06T11:07:44Z","title":"C$^2$LEVA: Toward Comprehensive and Contamination-Free Language Model Evaluation","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T21:10:35.180127Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2412.04947"},"observation_digest":"sha256:9d4b81ba80bc2779da2f821a815ece02aef1d580cd079edb057f19a50ef7accc","observation_id":"bfc745e1-9f25-4575-a545-a263e6708880","resolution":{"observed_at":"2026-08-11T21:10:35.180127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15740","last_updated":"2025-07-16T11:45:02Z","snapshot_observed_at":"2026-08-13T00:47:26.117565Z","submitted_at":"2024-03-23T06:36:32Z","title":"Protecting Copyrighted Material with Unique Identifiers in Large Language Model Training","version":3},"cited_work":{"arxiv_id":"2403.15740","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.15740","snapshot_observed_at":"2026-08-11T21:10:35.244768Z","title":"Protecting Copyrighted Material with Unique Identifiers in Large Language Model Training","venue":"cs.CL","work_id":"da215cfd-f09f-4d86-835b-4e064afda39b","year":2024},"citing_paper":{"arxiv_id":"2412.04947","last_updated":"2025-05-29T05:29:28Z","snapshot_observed_at":"2026-08-12T01:40:30.259470Z","submitted_at":"2024-12-06T11:07:44Z","title":"C$^2$LEVA: Toward Comprehensive and Contamination-Free Language Model Evaluation","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T21:10:35.185636Z"},"links":{"cited_paper":"/paper/2403.15740","citing_paper":"/paper/2412.04947"},"observation_digest":"sha256:46c2426e6bb32c4771b336e05b7daf767ab906b26eb85d4fa6bb769dff809a42","observation_id":"e959fbb2-d2da-4759-8552-aaf16c8b38e3","resolution":{"observed_at":"2026-08-11T21:10:35.252693Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:10:35.423680Z","title":"求你了，”她说，“请听我说。我是无辜的，我不应 该盗这儿来。 这一刻，特蕾西彻底明白了。她心里开始紧张起来了。“求你 了，","venue":null,"work_id":"5d5ecfab-ff1a-486d-816e-1bd7911294df","year":2023},"citing_paper":{"arxiv_id":"2412.04947","last_updated":"2025-05-29T05:29:28Z","snapshot_observed_at":"2026-08-12T01:40:30.259470Z","submitted_at":"2024-12-06T11:07:44Z","title":"C$^2$LEVA: Toward Comprehensive and Contamination-Free Language Model Evaluation","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T21:10:35.190360Z"},"links":{"citing_paper":"/paper/2412.04947"},"observation_digest":"sha256:8eff7004198c7469524b705f4f52c3ad08cdf5d5c589b926935dafe8a15867b0","observation_id":"0a12a8ae-8f99-4c59-871b-4f7b30932bb4","resolution":{"observed_at":"2026-08-11T21:10:35.428640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-12T16:46:46.561976Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-11T21:10:35.138219Z","title":"InAd- vances in Neural Information Processing Systems 33: Annual Conference on Neural Information Process- ing Systems 2020, NeurIPS 2020, December 6-12, 2020, virtual","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.04947","last_updated":"2025-05-29T05:29:28Z","snapshot_observed_at":"2026-08-12T01:40:30.259470Z","submitted_at":"2024-12-06T11:07:44Z","title":"C$^2$LEVA: Toward Comprehensive and Contamination-Free Language Model Evaluation","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-11T21:10:35.138219Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2412.04947"},"observation_digest":"sha256:a6ced799dee4ecd48ff2fcc0e2c201244b9a155d143131192de478fb9758c94f","observation_id":"10bae4c4-b63e-45b1-ba69-bb3fb1497cee","resolution":{"observed_at":"2026-08-11T21:10:35.138219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-11T21:10:35.144826Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04947","last_updated":"2025-05-29T05:29:28Z","snapshot_observed_at":"2026-08-12T01:40:30.259470Z","submitted_at":"2024-12-06T11:07:44Z","title":"C$^2$LEVA: Toward Comprehensive and Contamination-Free Language Model Evaluation","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T21:10:35.144826Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2412.04947"},"observation_digest":"sha256:4fde7d7a5ee805cafea5ce7c4b9c7abe419960fda3b2f5639d110278fd249c85","observation_id":"e9c46d1b-d396-46de-b887-109de254ed97","resolution":{"observed_at":"2026-08-11T21:10:35.144826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09110","last_updated":"2023-10-01T21:44:23Z","snapshot_observed_at":"2026-08-10T23:10:13.900680Z","submitted_at":"2022-11-16T18:51:34Z","title":"Holistic Evaluation of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09110","snapshot_observed_at":"2026-08-11T21:10:35.151341Z","title":"InProceedings of the 2023 Conference on Empirical Methods in Natural Language Processing, EMNLP 2023 - System Demonstrations, Singapore, December 6-10, 2023, pages 186–217","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04947","last_updated":"2025-05-29T05:29:28Z","snapshot_observed_at":"2026-08-12T01:40:30.259470Z","submitted_at":"2024-12-06T11:07:44Z","title":"C$^2$LEVA: Toward Comprehensive and Contamination-Free Language Model Evaluation","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T21:10:35.151341Z"},"links":{"cited_paper":"/paper/2211.09110","citing_paper":"/paper/2412.04947"},"observation_digest":"sha256:43e823930154cebe6ecbf5c63f702b7181398660871a2438b0397ed9294f73b3","observation_id":"496bbc29-aa5d-4013-9cc9-e5810ee50300","resolution":{"observed_at":"2026-08-11T21:10:35.151341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06565","last_updated":"2024-10-12T14:13:27Z","snapshot_observed_at":"2026-08-12T23:51:54.779130Z","submitted_at":"2024-06-03T05:47:05Z","title":"MixEval: Deriving Wisdom of the Crowd from LLM Benchmark Mixtures","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06565","snapshot_observed_at":"2026-08-11T21:10:35.157549Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04947","last_updated":"2025-05-29T05:29:28Z","snapshot_observed_at":"2026-08-12T01:40:30.259470Z","submitted_at":"2024-12-06T11:07:44Z","title":"C$^2$LEVA: Toward Comprehensive and Contamination-Free Language Model Evaluation","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T21:10:35.157549Z"},"links":{"cited_paper":"/paper/2406.06565","citing_paper":"/paper/2412.04947"},"observation_digest":"sha256:f2dd22cff1c0392e2194243b41f3b9d0453c2c2799dd482637782cb33abe8657","observation_id":"b1fd342f-1825-465d-aacd-248e310052f3","resolution":{"observed_at":"2026-08-11T21:10:35.157549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19314","last_updated":"2025-04-18T19:36:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-27T16:47:42Z","title":"LiveBench: A Challenging, Contamination-Limited LLM Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19314","snapshot_observed_at":"2026-08-11T21:10:35.174533Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04947","last_updated":"2025-05-29T05:29:28Z","snapshot_observed_at":"2026-08-12T01:40:30.259470Z","submitted_at":"2024-12-06T11:07:44Z","title":"C$^2$LEVA: Toward Comprehensive and Contamination-Free Language Model Evaluation","version":3},"reference_index":4012,"source":"pdf_text","source_observed_at":"2026-08-11T21:10:35.174533Z"},"links":{"cited_paper":"/paper/2406.19314","citing_paper":"/paper/2412.04947"},"observation_digest":"sha256:4c5de88dc2fe9835c7de5f42b410f2f500883c54bad339be188b5bf53b4435ea","observation_id":"cd4a9ce3-01b7-494b-946c-6097e04851e0","resolution":{"observed_at":"2026-08-11T21:10:35.174533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.04947","last_updated":"2025-05-29T05:29:28Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T01:40:30.259470Z","submitted_at":"2024-12-06T11:07:44Z","title":"C$^2$LEVA: Toward Comprehensive and Contamination-Free Language Model Evaluation"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2412.04947."}