{"as_of":"2026-08-07T09:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7b4469b718d0f532c4aa6514b24c137a6dc3599d5f50c44ef1ea6dcb1669d5ad","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:35:45.863740Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T22:47:36.908385Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.06979","last_updated":"2024-07-29T20:51:25Z","snapshot_observed_at":"2026-07-30T13:47:26.976057Z","submitted_at":"2023-09-13T14:15:03Z","title":"Auto-Regressive Next-Token Predictors are Universal Learners","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06979","snapshot_observed_at":"2026-08-06T20:35:45.863740Z","title":"Auto-regressive next-token predictors are universal learners","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.863740Z"},"links":{"cited_paper":"/paper/2309.06979","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:abc991835a075be099dc29e68ede3ba6cfb071410b0710da8c6494ecc00e512c","observation_id":"5bf35c01-612c-46e8-86fb-028b8ecd4be8","resolution":{"observed_at":"2026-08-06T20:35:45.863740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06979","last_updated":"2024-07-29T20:51:25Z","snapshot_observed_at":"2026-07-30T13:47:26.976057Z","submitted_at":"2023-09-13T14:15:03Z","title":"Auto-Regressive Next-Token Predictors are Universal Learners","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06979","snapshot_observed_at":"2026-08-06T18:41:33.187416Z","title":"cc/paper_files/paper/2017/file/ 8a20a8621978632d76c43dfd28b67767-Paper","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07544","last_updated":"2025-07-10T08:38:47Z","snapshot_observed_at":"2026-08-07T04:40:37.652382Z","submitted_at":"2025-07-10T08:38:47Z","title":"Position: We Need An Algorithmic Understanding of Generative AI","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T18:41:33.187416Z"},"links":{"cited_paper":"/paper/2309.06979","citing_paper":"/paper/2507.07544"},"observation_digest":"sha256:7675fae359195ab40a8aad55d94f0ad02378ecbf08fca40e4c267fc793cbc5d1","observation_id":"04ed9c3e-2180-4fbe-bd67-9b78533dea48","resolution":{"observed_at":"2026-08-06T18:41:33.187416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06979","last_updated":"2024-07-29T20:51:25Z","snapshot_observed_at":"2026-07-30T13:47:26.976057Z","submitted_at":"2023-09-13T14:15:03Z","title":"Auto-Regressive Next-Token Predictors are Universal Learners","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06979","snapshot_observed_at":"2026-08-06T18:02:50.341898Z","title":"Eran Malach and Shai Shalev-Shwartz","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15865","last_updated":"2025-07-26T07:05:22Z","snapshot_observed_at":"2026-08-06T17:47:14.624128Z","submitted_at":"2025-07-13T16:18:23Z","title":"From Reasoning to Super-Intelligence: A Search-Theoretic Perspective","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:02:50.341898Z"},"links":{"cited_paper":"/paper/2309.06979","citing_paper":"/paper/2507.15865"},"observation_digest":"sha256:c22d4f9cce2dbdab6e00236709554b9bb161598367810d73333c2fb0869dfcdc","observation_id":"650d6a4e-e4f1-4dba-bc1a-aa67a4fc7347","resolution":{"observed_at":"2026-08-06T18:02:50.341898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06979","last_updated":"2024-07-29T20:51:25Z","snapshot_observed_at":"2026-07-30T13:47:26.976057Z","submitted_at":"2023-09-13T14:15:03Z","title":"Auto-Regressive Next-Token Predictors are Universal Learners","version":3},"cited_work":{"arxiv_id":"2309.06979","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.06979","snapshot_observed_at":"2026-07-10T22:47:36.908385Z","title":"arXiv preprint arXiv:2309.06979 , year=","venue":"cs.LG","work_id":"71765b0f-60e2-408b-939c-87ac3f6285db","year":2023},"citing_paper":{"arxiv_id":"2510.26745","last_updated":"2026-05-18T17:56:38Z","snapshot_observed_at":"2026-08-02T20:19:54.425869Z","submitted_at":"2025-10-30T17:40:22Z","title":"Deep sequence models tend to memorize geometrically; it is unclear why","version":3},"reference_index":114,"source":"pdf_text","source_observed_at":"2026-05-21T20:38:18.005002Z"},"links":{"cited_paper":"/paper/2309.06979","citing_paper":"/paper/2510.26745"},"observation_digest":"sha256:a0c55af267ef2d59a5b923c2d3b5a79c22052c60429f16a2fb5a61c9cbbb23ff","observation_id":"b116862d-e901-4e6b-bfe6-4511396b3db3","resolution":{"observed_at":"2026-05-21T20:40:36.300354Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06979","last_updated":"2024-07-29T20:51:25Z","snapshot_observed_at":"2026-07-30T13:47:26.976057Z","submitted_at":"2023-09-13T14:15:03Z","title":"Auto-Regressive Next-Token Predictors are Universal Learners","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06979","snapshot_observed_at":"2026-08-03T06:26:56.954432Z","title":"Auto-regressive next-token predictors are universal learners","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.23207","last_updated":"2026-06-05T15:55:12Z","snapshot_observed_at":"2026-08-06T02:37:50.151833Z","submitted_at":"2026-01-30T17:31:26Z","title":"Learning to Execute Graph Algorithms Exactly with Graph Neural Networks","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-03T06:26:56.954432Z"},"links":{"cited_paper":"/paper/2309.06979","citing_paper":"/paper/2601.23207"},"observation_digest":"sha256:37d3c9720f8618ad3e6a4df06761b8e967cebf3aa3cf2b17c7543cf6b28563cd","observation_id":"ac6568ee-b235-4975-b97e-6041972a2a8a","resolution":{"observed_at":"2026-08-03T06:26:56.954432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06979","last_updated":"2024-07-29T20:51:25Z","snapshot_observed_at":"2026-07-30T13:47:26.976057Z","submitted_at":"2023-09-13T14:15:03Z","title":"Auto-Regressive Next-Token Predictors are Universal Learners","version":3},"cited_work":{"arxiv_id":"2309.06979","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.06979","snapshot_observed_at":"2026-07-10T22:47:36.908385Z","title":"arXiv preprint arXiv:2309.06979 , year=","venue":"cs.LG","work_id":"71765b0f-60e2-408b-939c-87ac3f6285db","year":2023},"citing_paper":{"arxiv_id":"2604.12013","last_updated":"2026-04-18T18:57:54Z","snapshot_observed_at":"2026-07-06T23:00:17.634307Z","submitted_at":"2026-04-13T20:00:13Z","title":"Sample Complexity of Autoregressive Reasoning: Chain-of-Thought vs. End-to-End","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T15:44:19.703107Z"},"links":{"cited_paper":"/paper/2309.06979","citing_paper":"/paper/2604.12013"},"observation_digest":"sha256:3b0b117d50eb44b0121097f7b3bce6e0ee1bb02ee0bafbcb83399a772e24ee69","observation_id":"055f5a41-18a0-406e-9739-07bc0769c634","resolution":{"observed_at":"2026-05-11T09:56:03.973938Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06979","last_updated":"2024-07-29T20:51:25Z","snapshot_observed_at":"2026-07-30T13:47:26.976057Z","submitted_at":"2023-09-13T14:15:03Z","title":"Auto-Regressive Next-Token Predictors are Universal Learners","version":3},"cited_work":{"arxiv_id":"2309.06979","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.06979","snapshot_observed_at":"2026-07-10T22:47:36.908385Z","title":"arXiv preprint arXiv:2309.06979 , year=","venue":"cs.LG","work_id":"71765b0f-60e2-408b-939c-87ac3f6285db","year":2023},"citing_paper":{"arxiv_id":"2605.06548","last_updated":"2026-05-07T16:44:56Z","snapshot_observed_at":"2026-08-04T07:00:09.042412Z","submitted_at":"2026-05-07T16:44:56Z","title":"Continuous Latent Diffusion Language Model","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-08T10:04:09.646578Z"},"links":{"cited_paper":"/paper/2309.06979","citing_paper":"/paper/2605.06548"},"observation_digest":"sha256:f4daf492b7a73e0e6b55e12f2a3a45faa9a24337cf4bedd55532e38327a5ddf0","observation_id":"991ced40-62b3-41d4-a320-d58dc96fbe38","resolution":{"observed_at":"2026-05-11T20:11:11.115920Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06979","last_updated":"2024-07-29T20:51:25Z","snapshot_observed_at":"2026-07-30T13:47:26.976057Z","submitted_at":"2023-09-13T14:15:03Z","title":"Auto-Regressive Next-Token Predictors are Universal Learners","version":3},"cited_work":{"arxiv_id":"2309.06979","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.06979","snapshot_observed_at":"2026-07-10T22:47:36.908385Z","title":"arXiv preprint arXiv:2309.06979 , year=","venue":"cs.LG","work_id":"71765b0f-60e2-408b-939c-87ac3f6285db","year":2023},"citing_paper":{"arxiv_id":"2605.06819","last_updated":"2026-05-07T18:21:05Z","snapshot_observed_at":"2026-07-06T23:19:15.382283Z","submitted_at":"2026-05-07T18:21:05Z","title":"A Theory of Online Learning with Autoregressive Chain-of-Thought Reasoning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-11T00:52:10.419984Z"},"links":{"cited_paper":"/paper/2309.06979","citing_paper":"/paper/2605.06819"},"observation_digest":"sha256:855c90bc5dd4021e2580fdbf121f24075e8001804cb870c3f2938e556c8085c5","observation_id":"138e46b6-2c65-4e15-8b31-ae43615224ec","resolution":{"observed_at":"2026-05-11T05:05:58.600104Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06979","last_updated":"2024-07-29T20:51:25Z","snapshot_observed_at":"2026-07-30T13:47:26.976057Z","submitted_at":"2023-09-13T14:15:03Z","title":"Auto-Regressive Next-Token Predictors are Universal Learners","version":3},"cited_work":{"arxiv_id":"2309.06979","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.06979","snapshot_observed_at":"2026-07-10T22:47:36.908385Z","title":"arXiv preprint arXiv:2309.06979 , year=","venue":"cs.LG","work_id":"71765b0f-60e2-408b-939c-87ac3f6285db","year":2023},"citing_paper":{"arxiv_id":"2605.22471","last_updated":"2026-05-21T13:32:20Z","snapshot_observed_at":"2026-08-02T11:52:59.155097Z","submitted_at":"2026-05-21T13:32:20Z","title":"Lost in Tokenization: Fundamental Trade-offs in Graph Tokenization for Transformers","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-22T07:03:52.438466Z"},"links":{"cited_paper":"/paper/2309.06979","citing_paper":"/paper/2605.22471"},"observation_digest":"sha256:e701f03123448515ffbe01792b7c46ca7c261e3741e4bd5ca630c6285cd6a423","observation_id":"18ab5746-ac34-473a-9338-82489b82ced7","resolution":{"observed_at":"2026-05-22T07:04:41.425565Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06979","last_updated":"2024-07-29T20:51:25Z","snapshot_observed_at":"2026-07-30T13:47:26.976057Z","submitted_at":"2023-09-13T14:15:03Z","title":"Auto-Regressive Next-Token Predictors are Universal Learners","version":3},"cited_work":{"arxiv_id":"2309.06979","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.06979","snapshot_observed_at":"2026-07-10T22:47:36.908385Z","title":"arXiv preprint arXiv:2309.06979 , year=","venue":"cs.LG","work_id":"71765b0f-60e2-408b-939c-87ac3f6285db","year":2023},"citing_paper":{"arxiv_id":"2606.09731","last_updated":"2026-07-23T03:50:50Z","snapshot_observed_at":"2026-08-04T15:25:58.819590Z","submitted_at":"2026-06-08T16:56:24Z","title":"Tight Sample Complexity of Transformers","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-27T17:33:48.373948Z"},"links":{"cited_paper":"/paper/2309.06979","citing_paper":"/paper/2606.09731"},"observation_digest":"sha256:7d141593974aa0017d30381e2c19de9434984853bc13d0d48d943066452cb49a","observation_id":"49a72d71-5ec1-460c-bec8-7301669ade2b","resolution":{"observed_at":"2026-07-02T23:57:29.162076Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06979","last_updated":"2024-07-29T20:51:25Z","snapshot_observed_at":"2026-07-30T13:47:26.976057Z","submitted_at":"2023-09-13T14:15:03Z","title":"Auto-Regressive Next-Token Predictors are Universal Learners","version":3},"cited_work":{"arxiv_id":"2309.06979","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.06979","snapshot_observed_at":"2026-07-10T22:47:36.908385Z","title":"arXiv preprint arXiv:2309.06979 , year=","venue":"cs.LG","work_id":"71765b0f-60e2-408b-939c-87ac3f6285db","year":2023},"citing_paper":{"arxiv_id":"2607.06720","last_updated":"2026-07-07T18:36:04Z","snapshot_observed_at":"2026-07-11T23:18:31.581552Z","submitted_at":"2026-07-07T18:36:04Z","title":"When Does In-Context Search Help? A Sampling-Complexity Theory of Reflection-Driven Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-10T22:46:24.057572Z"},"links":{"cited_paper":"/paper/2309.06979","citing_paper":"/paper/2607.06720"},"observation_digest":"sha256:eba13a0523538a884906583f3c5f41db791db372eb1d7a497ffc58c0df83fbae","observation_id":"3d6c804b-ca24-4ec5-b231-b2d8c0e290a6","resolution":{"observed_at":"2026-07-10T22:47:36.921943Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06979","last_updated":"2024-07-29T20:51:25Z","snapshot_observed_at":"2026-07-30T13:47:26.976057Z","submitted_at":"2023-09-13T14:15:03Z","title":"Auto-Regressive Next-Token Predictors are Universal Learners","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06979","snapshot_observed_at":"2026-08-01T20:54:17.295148Z","title":"arXiv preprint arXiv:2309.06979 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16528","last_updated":"2026-07-17T22:09:01Z","snapshot_observed_at":"2026-08-07T07:19:10.753414Z","submitted_at":"2026-07-17T22:09:01Z","title":"Hierarchical Domain Generalization","version":1},"reference_index":160,"source":"arxiv_source","source_observed_at":"2026-08-01T20:54:17.295148Z"},"links":{"cited_paper":"/paper/2309.06979","citing_paper":"/paper/2607.16528"},"observation_digest":"sha256:035b3b3cef7768cf78a64bfd0b14558582eacabcfc67113d31a3e4b508f48304","observation_id":"2833c456-4f0f-4b38-919a-b17d2bf6f33b","resolution":{"observed_at":"2026-08-01T20:54:17.295148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2309.06979/citation-record","integrity":"/paper/2309.06979/integrity","json":"/paper/2309.06979/citation-record.json","paper":"/paper/2309.06979"},"outbound":[],"paper":{"arxiv_id":"2309.06979","last_updated":"2024-07-29T20:51:25Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-30T13:47:26.976057Z","submitted_at":"2023-09-13T14:15:03Z","title":"Auto-Regressive Next-Token Predictors are Universal Learners"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2309.06979."}