{"as_of":"2026-08-07T23:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:932e8f3de98b8f48927fc92a55946afe02895240c0b42fa20efa7b342ad6eedc","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:37:03.512234Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:29:51.021694Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.11474","last_updated":"2025-01-29T10:27:40Z","snapshot_observed_at":"2026-08-01T02:34:03.509154Z","submitted_at":"2024-10-15T10:22:27Z","title":"How Transformers Get Rich: Approximation and Dynamics Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11474","snapshot_observed_at":"2026-08-06T16:37:03.512234Z","title":"How transformers implement induction heads: Approximation and optimization analysis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.13540","last_updated":"2025-07-30T01:51:41Z","snapshot_observed_at":"2026-08-07T22:00:27.833618Z","submitted_at":"2025-07-17T21:19:32Z","title":"Provable Low-Frequency Bias of In-Context Learning of Representations","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:37:03.512234Z"},"links":{"cited_paper":"/paper/2410.11474","citing_paper":"/paper/2507.13540"},"observation_digest":"sha256:1f19f20c3b6d84a0a626e19010a039619c5951aec7303567d8d61e4d84c0730b","observation_id":"e86347a4-52b2-4b0b-b888-38fbdd3e9914","resolution":{"observed_at":"2026-08-06T16:37:03.512234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11474","last_updated":"2025-01-29T10:27:40Z","snapshot_observed_at":"2026-08-01T02:34:03.509154Z","submitted_at":"2024-10-15T10:22:27Z","title":"How Transformers Get Rich: Approximation and Dynamics Analysis","version":3},"cited_work":{"arxiv_id":"2410.11474","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.11474","snapshot_observed_at":"2026-07-04T13:29:51.021694Z","title":"How transformers implement induction heads: Approxima- tion and optimization analysis.arXiv preprint arXiv:2410.11474, 2024a","venue":null,"work_id":"3b54b2dc-0a5f-48cf-b752-74ae6f6684e8","year":2025},"citing_paper":{"arxiv_id":"2601.19208","last_updated":"2026-05-12T21:37:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-27T05:22:34Z","title":"How Do Transformers Learn to Associate Tokens: Gradient Leading Terms Bring Mechanistic Interpretability","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T11:20:33.400885Z"},"links":{"cited_paper":"/paper/2410.11474","citing_paper":"/paper/2601.19208"},"observation_digest":"sha256:9cee0f3556eaadd79f10433129db5bc2aad35a2c732b0943f0fb75c41e3c7232","observation_id":"7e600c54-8f07-40bd-bf6f-c1db13a9dbd1","resolution":{"observed_at":"2026-05-16T11:20:52.700106Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11474","last_updated":"2025-01-29T10:27:40Z","snapshot_observed_at":"2026-08-01T02:34:03.509154Z","submitted_at":"2024-10-15T10:22:27Z","title":"How Transformers Get Rich: Approximation and Dynamics Analysis","version":3},"cited_work":{"arxiv_id":"2410.11474","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.11474","snapshot_observed_at":"2026-07-04T13:29:51.021694Z","title":"How transformers implement induction heads: Approxima- tion and optimization analysis.arXiv preprint arXiv:2410.11474, 2024a","venue":null,"work_id":"3b54b2dc-0a5f-48cf-b752-74ae6f6684e8","year":2025},"citing_paper":{"arxiv_id":"2606.04662","last_updated":"2026-06-03T09:40:30Z","snapshot_observed_at":"2026-07-06T23:44:42.700120Z","submitted_at":"2026-06-03T09:40:30Z","title":"Why Muon Outperforms Adam: A Curvature Perspective","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-06-28T07:04:21.012269Z"},"links":{"cited_paper":"/paper/2410.11474","citing_paper":"/paper/2606.04662"},"observation_digest":"sha256:cc4e07fb7848dce38fffc6d4806ae9488433fafad010330110b4ea540baaba1c","observation_id":"e79b6829-fe16-4969-ac22-6b4b5b7503b2","resolution":{"observed_at":"2026-07-02T07:06:45.020573Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11474","last_updated":"2025-01-29T10:27:40Z","snapshot_observed_at":"2026-08-01T02:34:03.509154Z","submitted_at":"2024-10-15T10:22:27Z","title":"How Transformers Get Rich: Approximation and Dynamics Analysis","version":3},"cited_work":{"arxiv_id":"2410.11474","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.11474","snapshot_observed_at":"2026-07-04T13:29:51.021694Z","title":"How transformers implement induction heads: Approxima- tion and optimization analysis.arXiv preprint arXiv:2410.11474, 2024a","venue":null,"work_id":"3b54b2dc-0a5f-48cf-b752-74ae6f6684e8","year":2025},"citing_paper":{"arxiv_id":"2606.12058","last_updated":"2026-06-10T13:26:56Z","snapshot_observed_at":"2026-07-06T23:51:02.805629Z","submitted_at":"2026-06-10T13:26:56Z","title":"Phase Transitions in Attention: A Bayesian Theory of Copy Head Emergence","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T08:13:40.546738Z"},"links":{"cited_paper":"/paper/2410.11474","citing_paper":"/paper/2606.12058"},"observation_digest":"sha256:d41585342e6cf65c8c852dccadd6a2b34434828a0f6046a6efbcf0ceb6ef5773","observation_id":"4fbb5b7c-2d6b-4f83-951b-35a53505ab36","resolution":{"observed_at":"2026-07-03T13:18:13.083937Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11474","last_updated":"2025-01-29T10:27:40Z","snapshot_observed_at":"2026-08-01T02:34:03.509154Z","submitted_at":"2024-10-15T10:22:27Z","title":"How Transformers Get Rich: Approximation and Dynamics Analysis","version":3},"cited_work":{"arxiv_id":"2410.11474","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.11474","snapshot_observed_at":"2026-07-04T13:29:51.021694Z","title":"How transformers implement induction heads: Approxima- tion and optimization analysis.arXiv preprint arXiv:2410.11474, 2024a","venue":null,"work_id":"3b54b2dc-0a5f-48cf-b752-74ae6f6684e8","year":2025},"citing_paper":{"arxiv_id":"2606.18164","last_updated":"2026-06-16T17:01:57Z","snapshot_observed_at":"2026-07-30T03:30:31.097644Z","submitted_at":"2026-06-16T17:01:57Z","title":"Learning Dynamics of Chain-of-Thought State Tracking in a Solvable Transformer Model","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T21:49:03.896740Z"},"links":{"cited_paper":"/paper/2410.11474","citing_paper":"/paper/2606.18164"},"observation_digest":"sha256:1cdb0663954564f8123d4dae2d29026d60d94e25fde97a1c931b8e78c8c1676d","observation_id":"a870090c-9c25-4094-bcbe-e10a9c8160ce","resolution":{"observed_at":"2026-07-03T23:39:05.186239Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11474","last_updated":"2025-01-29T10:27:40Z","snapshot_observed_at":"2026-08-01T02:34:03.509154Z","submitted_at":"2024-10-15T10:22:27Z","title":"How Transformers Get Rich: Approximation and Dynamics Analysis","version":3},"cited_work":{"arxiv_id":"2410.11474","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.11474","snapshot_observed_at":"2026-07-04T13:29:51.021694Z","title":"How transformers implement induction heads: Approxima- tion and optimization analysis.arXiv preprint arXiv:2410.11474, 2024a","venue":null,"work_id":"3b54b2dc-0a5f-48cf-b752-74ae6f6684e8","year":2025},"citing_paper":{"arxiv_id":"2606.26749","last_updated":"2026-06-25T08:33:34Z","snapshot_observed_at":"2026-08-01T16:00:20.311664Z","submitted_at":"2026-06-25T08:33:34Z","title":"Structure Before Collapse: Transient semantic geometry in next-token prediction","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-26T05:14:07.208255Z"},"links":{"cited_paper":"/paper/2410.11474","citing_paper":"/paper/2606.26749"},"observation_digest":"sha256:2c8e62ca4fb82b43dab88b70f8462b804031797d8f54d549ca69b8300950af11","observation_id":"794a5b5d-e100-4117-adb7-c6ac245eca7b","resolution":{"observed_at":"2026-07-04T13:29:51.023182Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11474","last_updated":"2025-01-29T10:27:40Z","snapshot_observed_at":"2026-08-01T02:34:03.509154Z","submitted_at":"2024-10-15T10:22:27Z","title":"How Transformers Get Rich: Approximation and Dynamics Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11474","snapshot_observed_at":"2026-08-01T21:30:59.304489Z","title":"arXiv preprint arXiv:2410.11474 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16072","last_updated":"2026-07-17T15:56:52Z","snapshot_observed_at":"2026-08-05T22:03:26.987913Z","submitted_at":"2026-07-17T15:56:52Z","title":"Frontier Language Models Struggle to Copy: Text Can Be Better Viewed in 2D","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T21:30:59.304489Z"},"links":{"cited_paper":"/paper/2410.11474","citing_paper":"/paper/2607.16072"},"observation_digest":"sha256:8eea8081fd6371335b497497c061720cec3f7bbf6a652e9c04b259d1d9c38fe6","observation_id":"021d6d9d-87b4-4e06-9406-f26597643ef0","resolution":{"observed_at":"2026-08-01T21:30:59.304489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.11474/citation-record","integrity":"/paper/2410.11474/integrity","json":"/paper/2410.11474/citation-record.json","paper":"/paper/2410.11474"},"outbound":[],"paper":{"arxiv_id":"2410.11474","last_updated":"2025-01-29T10:27:40Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-01T02:34:03.509154Z","submitted_at":"2024-10-15T10:22:27Z","title":"How Transformers Get Rich: Approximation and Dynamics Analysis"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2410.11474."}