{"as_of":"2026-08-06T13:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:474c4af8ccf962258088e8d99869cf45edd6fcd561ca4baa77b0578dd8f0c33b","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":5,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":5,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T23:10:40.420241Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T23:10:40.976975Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.02143","last_updated":"2024-06-04T05:49:50Z","snapshot_observed_at":"2026-07-06T16:56:46.051958Z","submitted_at":"2023-12-04T18:58:57Z","title":"Competition-Level Problems are Effective LLM Evaluators","version":3},"cited_work":{"arxiv_id":"2312.02143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.02143","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yiming Huang, Zhenghao Lin, Xiao Liu, Yeyun Gong, Shuai Lu, Fangyu Lei, Yaobo Liang, Yelong Shen, Chen Lin, Nan Duan, and Weizhu Chen","venue":null,"work_id":"0294c4fb-2bf2-480e-b9cd-a88222cb40a9","year":2023},"citing_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"reference_index":259,"source":"arxiv_source","source_observed_at":"2026-05-10T17:34:42.565806Z"},"links":{"cited_paper":"/paper/2312.02143","citing_paper":"/paper/2403.07974"},"observation_digest":"sha256:e1160cb4bfa52f954723016eddda116c14aeb0eb6ac34995853003b418596d62","observation_id":"ef6d5019-f883-453a-9dc3-45ec69b674ba","resolution":{"observed_at":"2026-05-10T17:34:42.915321Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02143","last_updated":"2024-06-04T05:49:50Z","snapshot_observed_at":"2026-07-06T16:56:46.051958Z","submitted_at":"2023-12-04T18:58:57Z","title":"Competition-Level Problems are Effective LLM Evaluators","version":3},"cited_work":{"arxiv_id":"2312.02143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.02143","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yiming Huang, Zhenghao Lin, Xiao Liu, Yeyun Gong, Shuai Lu, Fangyu Lei, Yaobo Liang, Yelong Shen, Chen Lin, Nan Duan, and Weizhu Chen","venue":null,"work_id":"0294c4fb-2bf2-480e-b9cd-a88222cb40a9","year":2023},"citing_paper":{"arxiv_id":"2406.04244","last_updated":"2024-06-06T16:41:39Z","snapshot_observed_at":"2026-07-30T15:43:06.151242Z","submitted_at":"2024-06-06T16:41:39Z","title":"Benchmark Data Contamination of Large Language Models: A Survey","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-22T23:10:40.420241Z"},"links":{"cited_paper":"/paper/2312.02143","citing_paper":"/paper/2406.04244"},"observation_digest":"sha256:1c2d05f6d4849e73e633e17c3f962e350d5b62165d61b1da5dbaaa616e7a3d22","observation_id":"c7a6f056-30ae-4c52-9b02-c7a49d20297a","resolution":{"observed_at":"2026-05-22T23:10:40.979836Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02143","last_updated":"2024-06-04T05:49:50Z","snapshot_observed_at":"2026-07-06T16:56:46.051958Z","submitted_at":"2023-12-04T18:58:57Z","title":"Competition-Level Problems are Effective LLM Evaluators","version":3},"cited_work":{"arxiv_id":"2312.02143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.02143","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yiming Huang, Zhenghao Lin, Xiao Liu, Yeyun Gong, Shuai Lu, Fangyu Lei, Yaobo Liang, Yelong Shen, Chen Lin, Nan Duan, and Weizhu Chen","venue":null,"work_id":"0294c4fb-2bf2-480e-b9cd-a88222cb40a9","year":2023},"citing_paper":{"arxiv_id":"2507.22359","last_updated":"2026-04-14T11:47:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-30T03:50:46Z","title":"League of LLMs: A Benchmark-Free Paradigm for Mutual Evaluation of Large Language Models","version":4},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-19T03:17:06.457421Z"},"links":{"cited_paper":"/paper/2312.02143","citing_paper":"/paper/2507.22359"},"observation_digest":"sha256:fdfc68f673fad199179882567c04ed0861db39d6db33c6b0383171aa84d718ba","observation_id":"66a5db3d-56cb-4e92-97d9-0cc2189d4012","resolution":{"observed_at":"2026-05-19T03:22:01.360747Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02143","last_updated":"2024-06-04T05:49:50Z","snapshot_observed_at":"2026-07-06T16:56:46.051958Z","submitted_at":"2023-12-04T18:58:57Z","title":"Competition-Level Problems are Effective LLM Evaluators","version":3},"cited_work":{"arxiv_id":"2312.02143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.02143","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yiming Huang, Zhenghao Lin, Xiao Liu, Yeyun Gong, Shuai Lu, Fangyu Lei, Yaobo Liang, Yelong Shen, Chen Lin, Nan Duan, and Weizhu Chen","venue":null,"work_id":"0294c4fb-2bf2-480e-b9cd-a88222cb40a9","year":2023},"citing_paper":{"arxiv_id":"2509.17677","last_updated":"2026-05-02T16:35:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-22T12:20:27Z","title":"EngiBench: A Benchmark for Evaluating Large Language Models on Engineering Problem Solving","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-18T15:08:03.793304Z"},"links":{"cited_paper":"/paper/2312.02143","citing_paper":"/paper/2509.17677"},"observation_digest":"sha256:33f2eba411df1d30d8f9d061c7148fa80d12f860f67231b3ec8701b511db75b8","observation_id":"6ecc6ae9-09b0-427f-a1f9-101da0c6a33f","resolution":{"observed_at":"2026-05-18T15:11:32.713054Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02143","last_updated":"2024-06-04T05:49:50Z","snapshot_observed_at":"2026-07-06T16:56:46.051958Z","submitted_at":"2023-12-04T18:58:57Z","title":"Competition-Level Problems are Effective LLM Evaluators","version":3},"cited_work":{"arxiv_id":"2312.02143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.02143","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yiming Huang, Zhenghao Lin, Xiao Liu, Yeyun Gong, Shuai Lu, Fangyu Lei, Yaobo Liang, Yelong Shen, Chen Lin, Nan Duan, and Weizhu Chen","venue":null,"work_id":"0294c4fb-2bf2-480e-b9cd-a88222cb40a9","year":2023},"citing_paper":{"arxiv_id":"2512.21132","last_updated":"2026-05-21T11:45:45Z","snapshot_observed_at":"2026-08-02T20:55:20.148773Z","submitted_at":"2025-12-24T12:02:00Z","title":"AutoBaxBuilder: Bootstrapping Code Security Benchmarking","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T12:15:45.967861Z"},"links":{"cited_paper":"/paper/2312.02143","citing_paper":"/paper/2512.21132"},"observation_digest":"sha256:708360f78cf0dfde2099cb1aba4b3c4d9dbde34291b33d745b883c6f22faf992","observation_id":"7cb9072a-e232-44bf-934b-86ca93832e31","resolution":{"observed_at":"2026-05-22T12:16:31.800716Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2312.02143/citation-record","integrity":"/paper/2312.02143/integrity","json":"/paper/2312.02143/citation-record.json","paper":"/paper/2312.02143"},"outbound":[],"paper":{"arxiv_id":"2312.02143","last_updated":"2024-06-04T05:49:50Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T16:56:46.051958Z","submitted_at":"2023-12-04T18:58:57Z","title":"Competition-Level Problems are Effective LLM Evaluators"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 5 inbound Pith citation observations for arXiv:2312.02143."}