{"as_of":"2026-08-09T06:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1d37d6759b7a0ea8b1f1aac12471195db22b1cfb467fd6f7b873926f46e04ae9","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T16:26:32.043593Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":18,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.03927","last_updated":"2024-02-22T12:32:24Z","snapshot_observed_at":"2026-07-06T17:26:10.790336Z","submitted_at":"2024-02-06T11:54:23Z","title":"Leak, Cheat, Repeat: Data Contamination and Evaluation Malpractices in Closed-Source LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03927","snapshot_observed_at":"2026-08-08T16:26:32.043593Z","title":"Leak, cheat, repeat: Data contamination and evaluation malpractices in closed-source llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06215","last_updated":"2025-02-10T07:33:49Z","snapshot_observed_at":"2026-08-08T16:20:48.947761Z","submitted_at":"2025-02-10T07:33:49Z","title":"LessLeak-Bench: A First Investigation of Data Leakage in LLMs Across 83 Software Engineering Benchmarks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T16:26:32.043593Z"},"links":{"cited_paper":"/paper/2402.03927","citing_paper":"/paper/2502.06215"},"observation_digest":"sha256:c987cd178faf44cead083d875b32bc2703fe0bd906a6b525e89525f4a7ddee10","observation_id":"aa10e7b4-9a06-4dc0-b1da-7b7e75627246","resolution":{"observed_at":"2026-08-08T16:26:32.043593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03927","last_updated":"2024-02-22T12:32:24Z","snapshot_observed_at":"2026-07-06T17:26:10.790336Z","submitted_at":"2024-02-06T11:54:23Z","title":"Leak, Cheat, Repeat: Data Contamination and Evaluation Malpractices in Closed-Source LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03927","snapshot_observed_at":"2026-08-08T14:04:30.135125Z","title":"Simone Balloccu, Patrícia Schmidtová, Mateusz Lango, and Ondˇrej Dušek","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07022","last_updated":"2025-02-10T20:30:32Z","snapshot_observed_at":"2026-08-08T13:59:04.617930Z","submitted_at":"2025-02-10T20:30:32Z","title":"AIMS.au: A Dataset for the Analysis of Modern Slavery Countermeasures in Corporate Statements","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T14:04:30.135125Z"},"links":{"cited_paper":"/paper/2402.03927","citing_paper":"/paper/2502.07022"},"observation_digest":"sha256:ca0df9319d040ac58d765e1987133b18c4725e9dce7440436f7b9a9756c7b47c","observation_id":"921a5f53-8fbf-46ae-bcb6-104c57184294","resolution":{"observed_at":"2026-08-08T14:04:30.135125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03927","last_updated":"2024-02-22T12:32:24Z","snapshot_observed_at":"2026-07-06T17:26:10.790336Z","submitted_at":"2024-02-06T11:54:23Z","title":"Leak, Cheat, Repeat: Data Contamination and Evaluation Malpractices in Closed-Source LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03927","snapshot_observed_at":"2026-08-07T14:05:14.101878Z","title":"Leak, cheat, repeat: Data contamination and evaluation malpractices in closed-source llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23796","last_updated":"2025-05-26T13:44:55Z","snapshot_observed_at":"2026-08-08T09:10:09.829642Z","submitted_at":"2025-05-26T13:44:55Z","title":"Emergent LLM behaviors are observationally equivalent to data leakage","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:14.101878Z"},"links":{"cited_paper":"/paper/2402.03927","citing_paper":"/paper/2505.23796"},"observation_digest":"sha256:227883983d5cee1fa2688e2903ddcdcbc159d0a9801161544743eb18e1ec447f","observation_id":"ddc01214-47f7-460b-9fbd-5013d2f2b2e6","resolution":{"observed_at":"2026-08-07T14:05:14.101878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03927","last_updated":"2024-02-22T12:32:24Z","snapshot_observed_at":"2026-07-06T17:26:10.790336Z","submitted_at":"2024-02-06T11:54:23Z","title":"Leak, Cheat, Repeat: Data Contamination and Evaluation Malpractices in Closed-Source LLMs","version":2},"cited_work":{"arxiv_id":"2402.03927","doi":"10.48550/arxiv.2402.03927","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.03927","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Leak, cheat, repeat: Data contamination and evaluation malpractices in closed-source llms.ArXiv, abs/2402.03927, 2024.https://api.semanticscholar.org/ CorpusID:267499939","venue":"arXiv (Cornell University)","work_id":"11794bb7-781c-4e6a-b9ce-f07512c978aa","year":2024},"citing_paper":{"arxiv_id":"2511.02627","last_updated":"2026-06-11T15:36:40Z","snapshot_observed_at":"2026-08-08T22:40:29.987506Z","submitted_at":"2025-11-04T14:57:11Z","title":"DecompSR: A dataset for decomposed analyses of compositional multihop spatial reasoning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T01:18:44.523602Z"},"links":{"cited_paper":"/paper/2402.03927","citing_paper":"/paper/2511.02627"},"observation_digest":"sha256:25e4a08ac082a8cd72f439965a8f69fd760402b26de642c2e9fad04f23731067","observation_id":"75c04252-af6e-42d3-a26c-52a51f0b002d","resolution":{"observed_at":"2026-05-18T01:20:34.441271Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03927","last_updated":"2024-02-22T12:32:24Z","snapshot_observed_at":"2026-07-06T17:26:10.790336Z","submitted_at":"2024-02-06T11:54:23Z","title":"Leak, Cheat, Repeat: Data Contamination and Evaluation Malpractices in Closed-Source LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03927","snapshot_observed_at":"2026-08-04T00:11:50.195992Z","title":"Leak, cheat, repeat: Data contamination and evaluation malpractices in closed-source llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.02627","last_updated":"2026-06-11T15:36:40Z","snapshot_observed_at":"2026-08-08T22:40:29.987506Z","submitted_at":"2025-11-04T14:57:11Z","title":"DecompSR: A dataset for decomposed analyses of compositional multihop spatial reasoning","version":4},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-04T00:11:50.195992Z"},"links":{"cited_paper":"/paper/2402.03927","citing_paper":"/paper/2511.02627"},"observation_digest":"sha256:278032b0492db170b07b070ee03a3c1ffdc80bad35474ca39661837682c2b379","observation_id":"062d1044-d54a-40c0-a1ca-11441b92821b","resolution":{"observed_at":"2026-08-04T00:11:50.195992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03927","last_updated":"2024-02-22T12:32:24Z","snapshot_observed_at":"2026-07-06T17:26:10.790336Z","submitted_at":"2024-02-06T11:54:23Z","title":"Leak, Cheat, Repeat: Data Contamination and Evaluation Malpractices in Closed-Source LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03927","snapshot_observed_at":"2026-08-03T03:04:43.114913Z","title":"Leak, cheat, repeat: Data contamination and evaluation malpractices in closed-source llms.arXiv preprint arXiv:2402.03927,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.09305","last_updated":"2026-06-28T18:13:37Z","snapshot_observed_at":"2026-08-08T13:06:41.126177Z","submitted_at":"2026-02-10T00:45:24Z","title":"Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T03:04:43.114913Z"},"links":{"cited_paper":"/paper/2402.03927","citing_paper":"/paper/2602.09305"},"observation_digest":"sha256:3edebf3197e377c67446d1d0f4f9e55c5a73272fc2e189856f0055f04b5c8238","observation_id":"b55e2365-36b5-4ea6-90cc-8c6fa82d3493","resolution":{"observed_at":"2026-08-03T03:04:43.114913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03927","last_updated":"2024-02-22T12:32:24Z","snapshot_observed_at":"2026-07-06T17:26:10.790336Z","submitted_at":"2024-02-06T11:54:23Z","title":"Leak, Cheat, Repeat: Data Contamination and Evaluation Malpractices in Closed-Source LLMs","version":2},"cited_work":{"arxiv_id":"2402.03927","doi":"10.48550/arxiv.2402.03927","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.03927","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Leak, cheat, repeat: Data contamination and evaluation malpractices in closed-source llms.ArXiv, abs/2402.03927, 2024.https://api.semanticscholar.org/ CorpusID:267499939","venue":"arXiv (Cornell University)","work_id":"11794bb7-781c-4e6a-b9ce-f07512c978aa","year":2024},"citing_paper":{"arxiv_id":"2604.04852","last_updated":"2026-04-06T16:53:52Z","snapshot_observed_at":"2026-08-02T21:39:50.942163Z","submitted_at":"2026-04-06T16:53:52Z","title":"Strengthening Human-Centric Chain-of-Thought Reasoning Integrity in LLMs via a Structured Prompt Framework","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:12.473010Z"},"links":{"cited_paper":"/paper/2402.03927","citing_paper":"/paper/2604.04852"},"observation_digest":"sha256:364b7e51477dd6244d26fc23feb552f49271118b7e0464945d497f37aa681bba","observation_id":"bfaa887b-ade1-4646-a0a7-6f870dfecc1a","resolution":{"observed_at":"2026-05-10T18:55:44.564388Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03927","last_updated":"2024-02-22T12:32:24Z","snapshot_observed_at":"2026-07-06T17:26:10.790336Z","submitted_at":"2024-02-06T11:54:23Z","title":"Leak, Cheat, Repeat: Data Contamination and Evaluation Malpractices in Closed-Source LLMs","version":2},"cited_work":{"arxiv_id":"2402.03927","doi":"10.48550/arxiv.2402.03927","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.03927","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Leak, cheat, repeat: Data contamination and evaluation malpractices in closed-source llms.ArXiv, abs/2402.03927, 2024.https://api.semanticscholar.org/ CorpusID:267499939","venue":"arXiv (Cornell University)","work_id":"11794bb7-781c-4e6a-b9ce-f07512c978aa","year":2024},"citing_paper":{"arxiv_id":"2605.17829","last_updated":"2026-05-18T04:03:18Z","snapshot_observed_at":"2026-08-05T06:31:55.615676Z","submitted_at":"2026-05-18T04:03:18Z","title":"Interactive Evaluation Requires a Design Science","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T10:55:08.135630Z"},"links":{"cited_paper":"/paper/2402.03927","citing_paper":"/paper/2605.17829"},"observation_digest":"sha256:dbc851afc3c5608f718b8e98e148bc9d4b9a350b470795ffcc298927a5204da3","observation_id":"25c2bb43-9552-4f13-828e-94a4ddb9dc64","resolution":{"observed_at":"2026-05-20T10:58:14.113824Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03927","last_updated":"2024-02-22T12:32:24Z","snapshot_observed_at":"2026-07-06T17:26:10.790336Z","submitted_at":"2024-02-06T11:54:23Z","title":"Leak, Cheat, Repeat: Data Contamination and Evaluation Malpractices in Closed-Source LLMs","version":2},"cited_work":{"arxiv_id":"2402.03927","doi":"10.48550/arxiv.2402.03927","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.03927","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Leak, cheat, repeat: Data contamination and evaluation malpractices in closed-source llms.ArXiv, abs/2402.03927, 2024.https://api.semanticscholar.org/ CorpusID:267499939","venue":"arXiv (Cornell University)","work_id":"11794bb7-781c-4e6a-b9ce-f07512c978aa","year":2024},"citing_paper":{"arxiv_id":"2605.26133","last_updated":"2026-05-21T10:32:33Z","snapshot_observed_at":"2026-08-07T10:44:40.983544Z","submitted_at":"2026-05-21T10:32:33Z","title":"Pretraining Data Exposure in Large Language Models: A Survey of Membership Inference, Data Contamination, and Security Implications","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T17:20:16.735285Z"},"links":{"cited_paper":"/paper/2402.03927","citing_paper":"/paper/2605.26133"},"observation_digest":"sha256:0e1a80221c55c1ebdf13fa95933427c7474fb450b1dfe9bb27b214fb74780027","observation_id":"4419564c-2605-4cd4-bf4d-3f18199ce9b6","resolution":{"observed_at":"2026-06-30T17:24:56.552879Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03927","last_updated":"2024-02-22T12:32:24Z","snapshot_observed_at":"2026-07-06T17:26:10.790336Z","submitted_at":"2024-02-06T11:54:23Z","title":"Leak, Cheat, Repeat: Data Contamination and Evaluation Malpractices in Closed-Source LLMs","version":2},"cited_work":{"arxiv_id":"2402.03927","doi":"10.48550/arxiv.2402.03927","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.03927","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Leak, cheat, repeat: Data contamination and evaluation malpractices in closed-source llms.ArXiv, abs/2402.03927, 2024.https://api.semanticscholar.org/ CorpusID:267499939","venue":"arXiv (Cornell University)","work_id":"11794bb7-781c-4e6a-b9ce-f07512c978aa","year":2024},"citing_paper":{"arxiv_id":"2606.03305","last_updated":"2026-07-01T19:01:29Z","snapshot_observed_at":"2026-08-02T11:54:02.200908Z","submitted_at":"2026-06-02T08:21:22Z","title":"The Reliability Gap in Benchmark Auditing: Distribution Shift and Scale as Failure Modes of Contamination Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T09:48:09.688745Z"},"links":{"cited_paper":"/paper/2402.03927","citing_paper":"/paper/2606.03305"},"observation_digest":"sha256:7226a765bf5492f8a7c73c9ec38c3ba46f30f74d70d790ef30a7951d95f90d22","observation_id":"e555ed24-e24f-4bbe-9cde-1e3c834064bc","resolution":{"observed_at":"2026-07-02T03:36:30.289844Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03927","last_updated":"2024-02-22T12:32:24Z","snapshot_observed_at":"2026-07-06T17:26:10.790336Z","submitted_at":"2024-02-06T11:54:23Z","title":"Leak, Cheat, Repeat: Data Contamination and Evaluation Malpractices in Closed-Source LLMs","version":2},"cited_work":{"arxiv_id":"2402.03927","doi":"10.48550/arxiv.2402.03927","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.03927","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Leak, cheat, repeat: Data contamination and evaluation malpractices in closed-source llms.ArXiv, abs/2402.03927, 2024.https://api.semanticscholar.org/ CorpusID:267499939","venue":"arXiv (Cornell University)","work_id":"11794bb7-781c-4e6a-b9ce-f07512c978aa","year":2024},"citing_paper":{"arxiv_id":"2606.03305","last_updated":"2026-07-01T19:01:29Z","snapshot_observed_at":"2026-08-02T11:54:02.200908Z","submitted_at":"2026-06-02T08:21:22Z","title":"The Reliability Gap in Benchmark Auditing: Distribution Shift and Scale as Failure Modes of Contamination Detection","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-04T00:30:13.665405Z"},"links":{"cited_paper":"/paper/2402.03927","citing_paper":"/paper/2606.03305"},"observation_digest":"sha256:0731d45ecb4895dcd98bfde76167b40e92d968c1b5bbc10c849de97ffeaaffb8","observation_id":"bbf8c6c6-a404-471a-bc98-cb11d8e6cc14","resolution":{"observed_at":"2026-07-04T00:39:16.467562Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2402.03927/citation-record","integrity":"/paper/2402.03927/integrity","json":"/paper/2402.03927/citation-record.json","paper":"/paper/2402.03927"},"outbound":[],"paper":{"arxiv_id":"2402.03927","last_updated":"2024-02-22T12:32:24Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T17:26:10.790336Z","submitted_at":"2024-02-06T11:54:23Z","title":"Leak, Cheat, Repeat: Data Contamination and Evaluation Malpractices in Closed-Source LLMs"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2402.03927."}