{"as_of":"2026-08-08T20:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e2530665f8293f0a08d6c8f6f464c230d1ddf083ae156cd6487f8d30ad72f34e","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T01:45:19.127391Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.14306/citation-record","integrity":"/paper/2607.14306/integrity","json":"/paper/2607.14306/citation-record.json","paper":"/paper/2607.14306"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-04T01:45:18.540645Z","title":"The pile: An 800gb dataset of diverse text for language modeling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-06T23:11:24.466675Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.540645Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:6029fe3611618f644bef7ade55e24c622b335e2c8c6f69fb441add0cd869a597","observation_id":"aa6f2505-82ca-46f3-a3ac-67c21dfb0bc3","resolution":{"observed_at":"2026-08-04T01:45:18.540645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.29548","last_updated":"2026-06-01T17:29:35Z","snapshot_observed_at":"2026-08-02T17:41:19.598860Z","submitted_at":"2026-05-28T08:02:11Z","title":"Why Larger Models Learn More: Effects of Capacity, Interference, and Rare-Task Retention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.29548","snapshot_observed_at":"2026-08-04T01:45:18.695606Z","title":"Why larger models learn more: Effects of capacity, interference, and rare-task retention.arXiv preprint arXiv:2605.29548,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-06T23:11:24.466675Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.695606Z"},"links":{"cited_paper":"/paper/2605.29548","citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:7f467cf1f2123fcd17ea4b47c9ae54475f1a7639cc040e8948f34944e8210da8","observation_id":"150c4578-eaf8-4766-b1d3-ced5db3b2652","resolution":{"observed_at":"2026-08-04T01:45:18.695606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-08-04T01:45:18.749882Z","title":"In-context learning and induction heads.arXiv preprint arXiv:2209.11895,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-06T23:11:24.466675Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.749882Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:bdb8838bf4110c195481165a34ae6e6a46085a19645afe46863d73a1c813c913","observation_id":"780bf20f-282f-46c5-85ef-4a661bf8fd7a","resolution":{"observed_at":"2026-08-04T01:45:18.749882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:45:18.821579Z","title":"Backtracking mathematical reasoning of language models to the pretraining data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-06T23:11:24.466675Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.821579Z"},"links":{"citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:520e1497dde66493c6b351737cbef50bc7e3a4b9f63de8fcae3aece21f7fd481","observation_id":"0cf14fd0-76dc-4043-90c9-9f4180ce1986","resolution":{"observed_at":"2026-08-04T01:45:18.821579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:45:18.971744Z","title":"Polypythias: Stability and outliers across fifty language model pre-training runs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-06T23:11:24.466675Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.971744Z"},"links":{"citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:486be114d03bb5726ebc7448c3839494539d58497fd5c0ddeb957c2626c91c62","observation_id":"46f28f8b-a6e8-48f7-bf91-c2189e23b6f3","resolution":{"observed_at":"2026-08-04T01:45:18.971744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:45:19.127391Z","title":"Jiasheng Ye, Peiju Liu, Tianxiang Sun, Jun Zhan, Yunhua Zhou, and Xipeng Qiu","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-06T23:11:24.466675Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:19.127391Z"},"links":{"citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:73c3e6d8fd295c0977aa024b10f42c534cba96fe57492464b238822c57465379","observation_id":"3676417d-e443-41f8-927c-9cc3d4a0c35f","resolution":{"observed_at":"2026-08-04T01:45:19.127391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03296","last_updated":"2023-08-07T04:47:42Z","snapshot_observed_at":"2026-07-06T16:03:14.694457Z","submitted_at":"2023-08-07T04:47:42Z","title":"Studying Large Language Model Generalization with Influence Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03296","snapshot_observed_at":"2026-08-04T01:45:18.619376Z","title":"Studying large language model generalization with influence functions.arXiv preprint arXiv:2308.03296,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-06T23:11:24.466675Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.619376Z"},"links":{"cited_paper":"/paper/2308.03296","citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:3583b21c1ec16cc0877b91fb09a8898e0afa94ce90e2f590cad62cb32c415aa7","observation_id":"5838fa0b-fa07-42dd-8f97-28d6d0efeb9d","resolution":{"observed_at":"2026-08-04T01:45:18.619376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06634","last_updated":"2024-07-09T17:44:00Z","snapshot_observed_at":"2026-07-06T17:42:33.242895Z","submitted_at":"2024-03-11T11:46:12Z","title":"Stealing Part of a Production Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06634","snapshot_observed_at":"2026-08-04T01:45:18.338994Z","title":"Stealing part of a production language model.arXiv preprint arXiv:2403.06634,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-06T23:11:24.466675Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.338994Z"},"links":{"cited_paper":"/paper/2403.06634","citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:3002b4f4fb09707dfb4303e72276bb95f84731dc12cfa6c218e324834fd85280","observation_id":"13dc8bbc-f492-4229-9cb5-4ada2d9b8f04","resolution":{"observed_at":"2026-08-04T01:45:18.338994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:45:18.298168Z","title":"Language contamination helps explains the cross-lingual capabilities of english pretrained models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-06T23:11:24.466675Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.298168Z"},"links":{"citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:612b05a1c5392716a5be1326c11691c5a8e3eb54312f83599223c87f5c24399a","observation_id":"90fcf031-a76e-4a02-b970-b99ba6125a6a","resolution":{"observed_at":"2026-08-04T01:45:18.298168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:45:18.393265Z","title":"Pretraining data statistics shape the phases of learning entity comparison in language models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-06T23:11:24.466675Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.393265Z"},"links":{"citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:24a6a4f22aa8847a55c3f1e4183b35dc1a3ee5dc46217956009dd6204351e915","observation_id":"c3aec7f0-926f-49ce-8ecf-62598d29d059","resolution":{"observed_at":"2026-08-04T01:45:18.393265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:45:19.044382Z","title":"Jason Wei, Dan Garrette, Tal Linzen, and Ellie Pavlick","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-06T23:11:24.466675Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:19.044382Z"},"links":{"citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:7e4671b62a00644a0274bb3ba06e913f5eb24957e8d039b16d32edeb2141640d","observation_id":"08e6c2ee-e8ef-488e-968a-145f1d8e271b","resolution":{"observed_at":"2026-08-04T01:45:19.044382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.14251","last_updated":"2023-03-24T07:18:59Z","snapshot_observed_at":"2026-08-02T02:24:26.318853Z","submitted_at":"2022-07-28T17:36:24Z","title":"Measuring Causal Effects of Data Statistics on Language Model's `Factual' Predictions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.14251","snapshot_observed_at":"2026-08-04T01:45:18.458866Z","title":"Measuring causal effects of data statistics on language model’sfactual’predictions.arXiv preprint arXiv:2207.14251,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-06T23:11:24.466675Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.458866Z"},"links":{"cited_paper":"/paper/2207.14251","citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:12fff23376590660fe7db3a8e6cecfc6c0b57f6e449df70bab45fb4b6f3529e2","observation_id":"df60d6c8-5a36-4e5f-9d43-e4f19ada691b","resolution":{"observed_at":"2026-08-04T01:45:18.458866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-06T23:11:24.466675Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 0 inbound Pith citation observations for arXiv:2607.14306."}