{"as_of":"2026-08-08T23:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:65b7880d7093a71711c74eb250153f068c33d48fe5448d64ea06f226b6370104","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:35:39.280865Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.06443","last_updated":"2024-06-10T16:34:43Z","snapshot_observed_at":"2026-07-06T18:28:16.301122Z","submitted_at":"2024-06-10T16:34:43Z","title":"LLM Dataset Inference: Did you train on my dataset?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06443","snapshot_observed_at":"2026-08-07T12:35:39.280865Z","title":"Llm dataset inference: Did you train on my dataset?, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24832","last_updated":"2025-06-18T15:27:03Z","snapshot_observed_at":"2026-08-08T09:16:38.722740Z","submitted_at":"2025-05-30T17:34:03Z","title":"How much do language models memorize?","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.280865Z"},"links":{"cited_paper":"/paper/2406.06443","citing_paper":"/paper/2505.24832"},"observation_digest":"sha256:abfa7ba48c445fa8cba109ac52b5f5bc785cfc619f7ba4323cca590dd7e6396f","observation_id":"5aee792e-13ff-4ef2-8fa5-6a7a8cddc7c1","resolution":{"observed_at":"2026-08-07T12:35:39.280865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06443","last_updated":"2024-06-10T16:34:43Z","snapshot_observed_at":"2026-07-06T18:28:16.301122Z","submitted_at":"2024-06-10T16:34:43Z","title":"LLM Dataset Inference: Did you train on my dataset?","version":1},"cited_work":{"arxiv_id":"2406.06443","doi":"10.48550/arxiv.2406.06443","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06443","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llm dataset inference: Did you train on my dataset?","venue":"arXiv (Cornell University)","work_id":"2a10ca4b-cec1-4bbe-b007-d0c3c372c051","year":2024},"citing_paper":{"arxiv_id":"2506.06057","last_updated":"2026-05-03T07:24:06Z","snapshot_observed_at":"2026-08-02T17:34:16.527589Z","submitted_at":"2025-06-06T13:02:59Z","title":"Hey, That's My Data! Token-Only Dataset Inference in Large Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-19T11:03:03.204840Z"},"links":{"cited_paper":"/paper/2406.06443","citing_paper":"/paper/2506.06057"},"observation_digest":"sha256:bf4196f02df66c4f55285e5cdcb2dcc968acd58af7f388e3fd6df638eb2470e0","observation_id":"a7246527-9915-4832-bb08-0e57d22b0e02","resolution":{"observed_at":"2026-05-19T11:07:15.808016Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06443","last_updated":"2024-06-10T16:34:43Z","snapshot_observed_at":"2026-07-06T18:28:16.301122Z","submitted_at":"2024-06-10T16:34:43Z","title":"LLM Dataset Inference: Did you train on my dataset?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06443","snapshot_observed_at":"2026-08-07T00:16:19.034749Z","title":"Llm dataset inference: Did you train on my dataset?arXiv preprint arXiv:2406.06443, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14913","last_updated":"2025-06-17T18:46:45Z","snapshot_observed_at":"2026-08-08T01:57:43.900224Z","submitted_at":"2025-06-17T18:46:45Z","title":"Winter Soldier: Backdooring Language Models at Pre-Training with Indirect Data Poisoning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:16:19.034749Z"},"links":{"cited_paper":"/paper/2406.06443","citing_paper":"/paper/2506.14913"},"observation_digest":"sha256:164a4ae7aaad7e3ec30f21cc45ba7b9d82aafd43739a9565c8eb09547f531c5a","observation_id":"5f7c7014-9e89-4a84-a147-51c8ed3253db","resolution":{"observed_at":"2026-08-07T00:16:19.034749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06443","last_updated":"2024-06-10T16:34:43Z","snapshot_observed_at":"2026-07-06T18:28:16.301122Z","submitted_at":"2024-06-10T16:34:43Z","title":"LLM Dataset Inference: Did you train on my dataset?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06443","snapshot_observed_at":"2026-08-06T21:36:41.288037Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23762","last_updated":"2025-06-30T12:09:29Z","snapshot_observed_at":"2026-08-06T21:29:49.550137Z","submitted_at":"2025-06-30T12:09:29Z","title":"Software Engineering for Large Language Models: Research Status, Challenges and the Road Ahead","version":1},"reference_index":247,"source":"pdf_text","source_observed_at":"2026-08-06T21:36:41.288037Z"},"links":{"cited_paper":"/paper/2406.06443","citing_paper":"/paper/2506.23762"},"observation_digest":"sha256:2775d3bddd27bd77a863f67fc9066947244c7e1318b417c0518acc6b07f85c76","observation_id":"abf6e969-5aaf-43d0-b77d-bbf33611eb9c","resolution":{"observed_at":"2026-08-06T21:36:41.288037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06443","last_updated":"2024-06-10T16:34:43Z","snapshot_observed_at":"2026-07-06T18:28:16.301122Z","submitted_at":"2024-06-10T16:34:43Z","title":"LLM Dataset Inference: Did you train on my dataset?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06443","snapshot_observed_at":"2026-08-05T16:50:24.774838Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17767","last_updated":"2025-09-13T01:49:58Z","snapshot_observed_at":"2026-08-06T11:47:39.038660Z","submitted_at":"2025-08-25T08:04:20Z","title":"ISACL: Internal State Analyzer for Copyrighted Training Data Leakage","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T16:50:24.774838Z"},"links":{"cited_paper":"/paper/2406.06443","citing_paper":"/paper/2508.17767"},"observation_digest":"sha256:50253ad5487fb36dc273c7a3474fc13e3e1829051f82e731cab719770ff88b07","observation_id":"71fb697e-52b2-446d-915d-6fcf813d88ee","resolution":{"observed_at":"2026-08-05T16:50:24.774838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06443","last_updated":"2024-06-10T16:34:43Z","snapshot_observed_at":"2026-07-06T18:28:16.301122Z","submitted_at":"2024-06-10T16:34:43Z","title":"LLM Dataset Inference: Did you train on my dataset?","version":1},"cited_work":{"arxiv_id":"2406.06443","doi":"10.48550/arxiv.2406.06443","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06443","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llm dataset inference: Did you train on my dataset?","venue":"arXiv (Cornell University)","work_id":"2a10ca4b-cec1-4bbe-b007-d0c3c372c051","year":2024},"citing_paper":{"arxiv_id":"2605.06865","last_updated":"2026-05-07T19:06:35Z","snapshot_observed_at":"2026-07-06T23:19:15.382283Z","submitted_at":"2026-05-07T19:06:35Z","title":"Dataset Watermarking for Closed LLMs with Provable Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-11T00:53:42.185498Z"},"links":{"cited_paper":"/paper/2406.06443","citing_paper":"/paper/2605.06865"},"observation_digest":"sha256:27531d6768497979576cf7c33db76b4ecb41408a98cace1b510648e08553b2d6","observation_id":"e6104cc9-fb67-4603-b7b3-a832dad94828","resolution":{"observed_at":"2026-05-11T05:00:57.201465Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06443","last_updated":"2024-06-10T16:34:43Z","snapshot_observed_at":"2026-07-06T18:28:16.301122Z","submitted_at":"2024-06-10T16:34:43Z","title":"LLM Dataset Inference: Did you train on my dataset?","version":1},"cited_work":{"arxiv_id":"2406.06443","doi":"10.48550/arxiv.2406.06443","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06443","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llm dataset inference: Did you train on my dataset?","venue":"arXiv (Cornell University)","work_id":"2a10ca4b-cec1-4bbe-b007-d0c3c372c051","year":2024},"citing_paper":{"arxiv_id":"2605.07878","last_updated":"2026-05-08T15:32:35Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T15:32:35Z","title":"Black-box model classification under the discriminative factorization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-11T02:24:37.402352Z"},"links":{"cited_paper":"/paper/2406.06443","citing_paper":"/paper/2605.07878"},"observation_digest":"sha256:092af4eef872f4d9ad27fe874a0d66db789d5d85272ac28118b1bce270aed729","observation_id":"b9b4f8bd-c55e-4dca-a2bf-79f83e57bcb8","resolution":{"observed_at":"2026-05-11T02:25:53.814813Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06443","last_updated":"2024-06-10T16:34:43Z","snapshot_observed_at":"2026-07-06T18:28:16.301122Z","submitted_at":"2024-06-10T16:34:43Z","title":"LLM Dataset Inference: Did you train on my dataset?","version":1},"cited_work":{"arxiv_id":"2406.06443","doi":"10.48550/arxiv.2406.06443","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06443","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llm dataset inference: Did you train on my dataset?","venue":"arXiv (Cornell University)","work_id":"2a10ca4b-cec1-4bbe-b007-d0c3c372c051","year":2024},"citing_paper":{"arxiv_id":"2605.30462","last_updated":"2026-05-28T18:38:15Z","snapshot_observed_at":"2026-07-06T23:39:43.967889Z","submitted_at":"2026-05-28T18:38:15Z","title":"idSCD: Identifying Training Datasets through Semantic Correlation Descriptors","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-29T08:35:36.928378Z"},"links":{"cited_paper":"/paper/2406.06443","citing_paper":"/paper/2605.30462"},"observation_digest":"sha256:11dede0881eb87bf6257ff97f827e9b21b018f22105ed42c3c02b6060c49b3f8","observation_id":"9b27a075-018e-4e9b-bb0f-7e73b1147892","resolution":{"observed_at":"2026-06-29T08:43:15.840910Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06443","last_updated":"2024-06-10T16:34:43Z","snapshot_observed_at":"2026-07-06T18:28:16.301122Z","submitted_at":"2024-06-10T16:34:43Z","title":"LLM Dataset Inference: Did you train on my dataset?","version":1},"cited_work":{"arxiv_id":"2406.06443","doi":"10.48550/arxiv.2406.06443","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06443","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llm dataset inference: Did you train on my dataset?","venue":"arXiv (Cornell University)","work_id":"2a10ca4b-cec1-4bbe-b007-d0c3c372c051","year":2024},"citing_paper":{"arxiv_id":"2606.03305","last_updated":"2026-07-01T19:01:29Z","snapshot_observed_at":"2026-08-02T11:54:02.200908Z","submitted_at":"2026-06-02T08:21:22Z","title":"The Reliability Gap in Benchmark Auditing: Distribution Shift and Scale as Failure Modes of Contamination Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T09:48:09.688745Z"},"links":{"cited_paper":"/paper/2406.06443","citing_paper":"/paper/2606.03305"},"observation_digest":"sha256:c22c4edac7c94d36f4eed93ba68b4e891e218b94a67988d3dd1109278a1f8c98","observation_id":"86f72514-894e-49ec-9dcb-0cd734ffc43c","resolution":{"observed_at":"2026-07-02T03:36:30.321415Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06443","last_updated":"2024-06-10T16:34:43Z","snapshot_observed_at":"2026-07-06T18:28:16.301122Z","submitted_at":"2024-06-10T16:34:43Z","title":"LLM Dataset Inference: Did you train on my dataset?","version":1},"cited_work":{"arxiv_id":"2406.06443","doi":"10.48550/arxiv.2406.06443","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06443","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llm dataset inference: Did you train on my dataset?","venue":"arXiv (Cornell University)","work_id":"2a10ca4b-cec1-4bbe-b007-d0c3c372c051","year":2024},"citing_paper":{"arxiv_id":"2606.03305","last_updated":"2026-07-01T19:01:29Z","snapshot_observed_at":"2026-08-02T11:54:02.200908Z","submitted_at":"2026-06-02T08:21:22Z","title":"The Reliability Gap in Benchmark Auditing: Distribution Shift and Scale as Failure Modes of Contamination Detection","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-04T00:30:13.665405Z"},"links":{"cited_paper":"/paper/2406.06443","citing_paper":"/paper/2606.03305"},"observation_digest":"sha256:d8ed3500b897c9dbffc0228bfd1046cff3f704c571c3afb46bce22278a4c7742","observation_id":"7292f596-fc39-479c-a9a2-1df43c3eed68","resolution":{"observed_at":"2026-07-04T00:39:16.467042Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06443","last_updated":"2024-06-10T16:34:43Z","snapshot_observed_at":"2026-07-06T18:28:16.301122Z","submitted_at":"2024-06-10T16:34:43Z","title":"LLM Dataset Inference: Did you train on my dataset?","version":1},"cited_work":{"arxiv_id":"2406.06443","doi":"10.48550/arxiv.2406.06443","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06443","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llm dataset inference: Did you train on my dataset?","venue":"arXiv (Cornell University)","work_id":"2a10ca4b-cec1-4bbe-b007-d0c3c372c051","year":2024},"citing_paper":{"arxiv_id":"2606.31991","last_updated":"2026-06-30T17:29:04Z","snapshot_observed_at":"2026-07-07T00:05:37.068846Z","submitted_at":"2026-06-30T17:29:04Z","title":"Amplifying Membership Signal Through Chained Regeneration","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-01T06:22:08.140403Z"},"links":{"cited_paper":"/paper/2406.06443","citing_paper":"/paper/2606.31991"},"observation_digest":"sha256:9644efcac51a48d2d3da01cdb9862b24c1e8baefe524becfeaef1aadce3535d8","observation_id":"4beef2ce-244a-4328-9c35-bebcfbeb96b3","resolution":{"observed_at":"2026-07-01T06:25:26.771461Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06443","last_updated":"2024-06-10T16:34:43Z","snapshot_observed_at":"2026-07-06T18:28:16.301122Z","submitted_at":"2024-06-10T16:34:43Z","title":"LLM Dataset Inference: Did you train on my dataset?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06443","snapshot_observed_at":"2026-07-14T17:39:28.270033Z","title":"Llm dataset inference: Did you train on my dataset?, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09692","last_updated":"2026-06-19T06:59:19Z","snapshot_observed_at":"2026-07-30T09:44:36.800265Z","submitted_at":"2026-06-19T06:59:19Z","title":"Reference-Based Distillation Detection in LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T17:39:28.270033Z"},"links":{"cited_paper":"/paper/2406.06443","citing_paper":"/paper/2607.09692"},"observation_digest":"sha256:bc9745eb21ce44e86a1f37610d4b9ecd9fe84dac5760312fd143216a8b819559","observation_id":"4c533d09-9a9a-4814-a71c-dbd3ee9a2b11","resolution":{"observed_at":"2026-07-14T17:39:28.270033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.06443/citation-record","integrity":"/paper/2406.06443/integrity","json":"/paper/2406.06443/citation-record.json","paper":"/paper/2406.06443"},"outbound":[],"paper":{"arxiv_id":"2406.06443","last_updated":"2024-06-10T16:34:43Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T18:28:16.301122Z","submitted_at":"2024-06-10T16:34:43Z","title":"LLM Dataset Inference: Did you train on my dataset?"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2406.06443."}