{"as_of":"2026-08-08T10:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e8a799811ce0014d34ecc00c4f9b478a8306696073e790fd42d7431d582d74d8","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:57:22.619625Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T23:39:05.233326Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2210.05675","last_updated":"2022-10-13T14:06:09Z","snapshot_observed_at":"2026-08-06T08:59:00.500125Z","submitted_at":"2022-10-11T09:29:19Z","title":"Transformers generalize differently from information stored in context vs in weights","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.05675","snapshot_observed_at":"2026-08-07T11:57:22.619625Z","title":"Transformers generalize differently from information stored in context vs in weights.arXiv preprint arXiv:2210.05675, 2022","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01115","last_updated":"2025-09-03T19:18:47Z","snapshot_observed_at":"2026-08-07T11:48:16.522772Z","submitted_at":"2025-06-01T18:42:39Z","title":"Is Random Attention Sufficient for Sequence Modeling? Disentangling Trainable Components in the Transformer","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:22.619625Z"},"links":{"cited_paper":"/paper/2210.05675","citing_paper":"/paper/2506.01115"},"observation_digest":"sha256:5f42ac87e63bf1856781b1ca3c7063c67da8fe88bbd4bce5ff1bc95cd8ba15d9","observation_id":"3191c054-6843-42be-a1a1-84be8dbd1f98","resolution":{"observed_at":"2026-08-07T11:57:22.619625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05675","last_updated":"2022-10-13T14:06:09Z","snapshot_observed_at":"2026-08-06T08:59:00.500125Z","submitted_at":"2022-10-11T09:29:19Z","title":"Transformers generalize differently from information stored in context vs in weights","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.05675","snapshot_observed_at":"2026-08-05T18:15:50.527032Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.15021","last_updated":"2025-08-20T19:24:49Z","snapshot_observed_at":"2026-08-08T01:58:17.969373Z","submitted_at":"2025-08-20T19:24:49Z","title":"In-Context Iterative Policy Improvement for Dynamic Manipulation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T18:15:50.527032Z"},"links":{"cited_paper":"/paper/2210.05675","citing_paper":"/paper/2508.15021"},"observation_digest":"sha256:4c4ecd65496eb7d748c9bef7ac0e4eebc8ca44b4f984abdbe08c0edf78a41944","observation_id":"f2dc8e27-f690-4c76-9182-6213ac895bc4","resolution":{"observed_at":"2026-08-05T18:15:50.527032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05675","last_updated":"2022-10-13T14:06:09Z","snapshot_observed_at":"2026-08-06T08:59:00.500125Z","submitted_at":"2022-10-11T09:29:19Z","title":"Transformers generalize differently from information stored in context vs in weights","version":2},"cited_work":{"arxiv_id":"2210.05675","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.05675","snapshot_observed_at":"2026-07-03T23:39:05.233326Z","title":"arXiv preprint arXiv:2210.05675 , year=","venue":null,"work_id":"ee010e7b-1510-42df-8659-1e460fc63dad","year":2022},"citing_paper":{"arxiv_id":"2604.21632","last_updated":"2026-04-23T12:51:10Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:51:10Z","title":"To See the Unseen: on the Generalization Ability of Transformers in Symbolic Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-09T22:18:14.788882Z"},"links":{"cited_paper":"/paper/2210.05675","citing_paper":"/paper/2604.21632"},"observation_digest":"sha256:8d67cbc2db0978d52b42188434bc57097189c5377da7e84807d94aca3f890807","observation_id":"07f225cd-e82c-419e-a5bb-cd98247736e9","resolution":{"observed_at":"2026-05-09T22:49:15.793055Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05675","last_updated":"2022-10-13T14:06:09Z","snapshot_observed_at":"2026-08-06T08:59:00.500125Z","submitted_at":"2022-10-11T09:29:19Z","title":"Transformers generalize differently from information stored in context vs in weights","version":2},"cited_work":{"arxiv_id":"2210.05675","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.05675","snapshot_observed_at":"2026-07-03T23:39:05.233326Z","title":"arXiv preprint arXiv:2210.05675 , year=","venue":null,"work_id":"ee010e7b-1510-42df-8659-1e460fc63dad","year":2022},"citing_paper":{"arxiv_id":"2605.05115","last_updated":"2026-05-06T16:46:03Z","snapshot_observed_at":"2026-08-07T10:12:24.411121Z","submitted_at":"2026-05-06T16:46:03Z","title":"Manifold Steering Reveals the Shared Geometry of Neural Network Representation and Behavior","version":1},"reference_index":300,"source":"arxiv_source","source_observed_at":"2026-05-08T17:47:09.591001Z"},"links":{"cited_paper":"/paper/2210.05675","citing_paper":"/paper/2605.05115"},"observation_digest":"sha256:71ba623d320a79c88d5bed3ab13dbd017bd45ebeed2cd9939d184b0a1b765f23","observation_id":"0fe43193-b1fc-4672-9961-1f3eb17f24f6","resolution":{"observed_at":"2026-05-11T17:16:06.563360Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05675","last_updated":"2022-10-13T14:06:09Z","snapshot_observed_at":"2026-08-06T08:59:00.500125Z","submitted_at":"2022-10-11T09:29:19Z","title":"Transformers generalize differently from information stored in context vs in weights","version":2},"cited_work":{"arxiv_id":"2210.05675","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.05675","snapshot_observed_at":"2026-07-03T23:39:05.233326Z","title":"arXiv preprint arXiv:2210.05675 , year=","venue":null,"work_id":"ee010e7b-1510-42df-8659-1e460fc63dad","year":2022},"citing_paper":{"arxiv_id":"2605.12412","last_updated":"2026-05-12T17:09:41Z","snapshot_observed_at":"2026-07-06T23:24:08.763444Z","submitted_at":"2026-05-12T17:09:41Z","title":"Stories in Space: In-Context Learning Trajectories in Conceptual Belief Space","version":1},"reference_index":127,"source":"arxiv_source","source_observed_at":"2026-05-13T05:17:34.283917Z"},"links":{"cited_paper":"/paper/2210.05675","citing_paper":"/paper/2605.12412"},"observation_digest":"sha256:8dede17245fb4a7c84d3cc18ae7501150d10a498b0831da57537986c60b5a93e","observation_id":"c6e1149b-f689-4092-a9b9-723fef9295b9","resolution":{"observed_at":"2026-05-13T05:27:19.337224Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05675","last_updated":"2022-10-13T14:06:09Z","snapshot_observed_at":"2026-08-06T08:59:00.500125Z","submitted_at":"2022-10-11T09:29:19Z","title":"Transformers generalize differently from information stored in context vs in weights","version":2},"cited_work":{"arxiv_id":"2210.05675","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.05675","snapshot_observed_at":"2026-07-03T23:39:05.233326Z","title":"arXiv preprint arXiv:2210.05675 , year=","venue":null,"work_id":"ee010e7b-1510-42df-8659-1e460fc63dad","year":2022},"citing_paper":{"arxiv_id":"2606.18164","last_updated":"2026-06-16T17:01:57Z","snapshot_observed_at":"2026-07-30T03:30:31.097644Z","submitted_at":"2026-06-16T17:01:57Z","title":"Learning Dynamics of Chain-of-Thought State Tracking in a Solvable Transformer Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T21:49:03.896740Z"},"links":{"cited_paper":"/paper/2210.05675","citing_paper":"/paper/2606.18164"},"observation_digest":"sha256:8458acbe435f4f867c8ce138671ba69817ec9a70406024da61d75fa30abf81ab","observation_id":"095840ca-8fd3-4a4d-ac67-ad66039fe297","resolution":{"observed_at":"2026-07-03T23:39:05.236068Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05675","last_updated":"2022-10-13T14:06:09Z","snapshot_observed_at":"2026-08-06T08:59:00.500125Z","submitted_at":"2022-10-11T09:29:19Z","title":"Transformers generalize differently from information stored in context vs in weights","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.05675","snapshot_observed_at":"2026-07-11T11:22:48.469230Z","title":"Róbert Csordás, Kazuki Irie, and Jürgen Schmidhuber","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04926","last_updated":"2026-07-06T10:55:56Z","snapshot_observed_at":"2026-08-08T02:39:22.636994Z","submitted_at":"2026-07-06T10:55:56Z","title":"Input Pathways Shape Few-Shot, Not Zero-Shot, Binding in Tiny Transformers: A Fully-Enumerable Study","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-11T11:22:48.469230Z"},"links":{"cited_paper":"/paper/2210.05675","citing_paper":"/paper/2607.04926"},"observation_digest":"sha256:f6d7a878c5c1daa1795884c555720af175868703f5afcc43a5ca920e79d5c2cc","observation_id":"9279d21e-b780-4e6c-845b-cf9e0849f244","resolution":{"observed_at":"2026-07-11T11:22:48.469230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05675","last_updated":"2022-10-13T14:06:09Z","snapshot_observed_at":"2026-08-06T08:59:00.500125Z","submitted_at":"2022-10-11T09:29:19Z","title":"Transformers generalize differently from information stored in context vs in weights","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.05675","snapshot_observed_at":"2026-07-14T07:36:43.499258Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11020","last_updated":"2026-07-14T05:59:33Z","snapshot_observed_at":"2026-08-05T22:32:33.467630Z","submitted_at":"2026-07-13T02:39:38Z","title":"Can a Language Model Learn Facts Continually in Its Weights?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T07:36:43.499258Z"},"links":{"cited_paper":"/paper/2210.05675","citing_paper":"/paper/2607.11020"},"observation_digest":"sha256:b8e0e3c2c1acfb9858f378862fa2c69dd3adf690682e11ba01af628e1a4bd143","observation_id":"bfb0a00d-e7eb-4a97-a324-00c9d77f9b10","resolution":{"observed_at":"2026-07-14T07:36:43.499258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2210.05675/citation-record","integrity":"/paper/2210.05675/integrity","json":"/paper/2210.05675/citation-record.json","paper":"/paper/2210.05675"},"outbound":[],"paper":{"arxiv_id":"2210.05675","last_updated":"2022-10-13T14:06:09Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T08:59:00.500125Z","submitted_at":"2022-10-11T09:29:19Z","title":"Transformers generalize differently from information stored in context vs in weights"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2210.05675."}