{"as_of":"2026-08-13T04:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b3e09b0482fd57fd96afa9266238778cdadb97178e8bf6b107e5f51d8d45c897","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T14:35:02.320784Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T07:29:24.656530Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T07:34:21.626740Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"cited_work":{"arxiv_id":"2412.11867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.11867","snapshot_observed_at":"2026-06-30T07:34:21.626740Z","title":"Spies, William Edwards, Michael I","venue":null,"work_id":"50d42432-6bba-4209-a3c9-0af0bde7120b","year":2025},"citing_paper":{"arxiv_id":"2604.22227","last_updated":"2026-04-29T07:51:58Z","snapshot_observed_at":"2026-08-11T23:45:02.118870Z","submitted_at":"2026-04-24T05:02:20Z","title":"A Co-Evolutionary Theory of Human-AI Coexistence: Mutualism, Governance, and Dynamics in Complex Societies","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-08T09:51:33.783535Z"},"links":{"cited_paper":"/paper/2412.11867","citing_paper":"/paper/2604.22227"},"observation_digest":"sha256:44cd81c3cf70cf0b8e2e2af38a209b34accd9bbba9deae4f11cc9301a6ab2fe8","observation_id":"1245c3f9-0ba0-405f-8c8d-fdf6f0a6fbe9","resolution":{"observed_at":"2026-05-11T20:16:08.936468Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"cited_work":{"arxiv_id":"2412.11867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.11867","snapshot_observed_at":"2026-06-30T07:34:21.626740Z","title":"Spies, William Edwards, Michael I","venue":null,"work_id":"50d42432-6bba-4209-a3c9-0af0bde7120b","year":2025},"citing_paper":{"arxiv_id":"2605.20784","last_updated":"2026-05-20T06:25:49Z","snapshot_observed_at":"2026-07-06T23:31:18.520630Z","submitted_at":"2026-05-20T06:25:49Z","title":"Interaction Locality in Hierarchical Recursive Reasoning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-21T05:04:14.532933Z"},"links":{"cited_paper":"/paper/2412.11867","citing_paper":"/paper/2605.20784"},"observation_digest":"sha256:ca54e20bdea927105daa3e6bd82988f598f88a2165e487e17ab9835728541b4c","observation_id":"639df370-b7d8-4661-b2fc-7e397cfb41b7","resolution":{"observed_at":"2026-05-21T05:04:37.210641Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"cited_work":{"arxiv_id":"2412.11867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.11867","snapshot_observed_at":"2026-06-30T07:34:21.626740Z","title":"Spies, William Edwards, Michael I","venue":null,"work_id":"50d42432-6bba-4209-a3c9-0af0bde7120b","year":2025},"citing_paper":{"arxiv_id":"2606.29315","last_updated":"2026-06-28T10:21:55Z","snapshot_observed_at":"2026-08-05T11:59:47.223958Z","submitted_at":"2026-06-28T10:21:55Z","title":"Hierarchical Experimentalist Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T07:29:24.656530Z"},"links":{"cited_paper":"/paper/2412.11867","citing_paper":"/paper/2606.29315"},"observation_digest":"sha256:bc7504528c9d3d0e16f9747e394a3b3b1152336d8e0492445a8c5ce34824218a","observation_id":"701e4781-67ff-4f63-b6ea-d7d59ededb3c","resolution":{"observed_at":"2026-06-30T07:34:21.628437Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.11867/citation-record","integrity":"/paper/2412.11867/integrity","json":"/paper/2412.11867/citation-record.json","paper":"/paper/2412.11867"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1610.01644","last_updated":"2018-11-22T23:40:00Z","snapshot_observed_at":"2026-08-09T22:50:03.459615Z","submitted_at":"2016-10-05T20:59:01Z","title":"Understanding intermediate layers using linear classifier probes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01644","snapshot_observed_at":"2026-08-11T14:35:02.214193Z","title":"Understanding intermediate layers using linear classifier probes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.214193Z"},"links":{"cited_paper":"/paper/1610.01644","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:0e8954b68703652c8dcb903cb70fd8cac9702713f2fc6330c398830be67deb6e","observation_id":"ad6820a7-19e1-403c-b153-3420259e9e13","resolution":{"observed_at":"2026-08-11T14:35:02.214193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:35:02.621553Z","title":null,"venue":null,"work_id":"97bc9f55-0ded-47ca-be82-0cab4cb3081d","year":2025},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.304268Z"},"links":{"citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:b2f12f6d5873e34c6bc88f32ea243d10aec022803689b2ee0bd9e10020227b96","observation_id":"fb8e1ec8-914d-4e19-819b-4f47327e8ea7","resolution":{"observed_at":"2026-08-11T14:35:02.625767Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-11T07:21:14.568175Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-11T14:35:02.228788Z","title":"Nelson Elhage, Neel Nanda, Catherine Olsson, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.228788Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:4ecacb9752cf79000b7b247a9bbebb468aaefc7a502b2fb7e6377cdb5366d509","observation_id":"0fcc66e0-6d0c-4c5f-8663-72ea7388104c","resolution":{"observed_at":"2026-08-11T14:35:02.228788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:35:02.608915Z","title":"1- and 3-back","venue":null,"work_id":"a329f8cb-1836-4c92-8743-04786ddf9727","year":2024},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.308523Z"},"links":{"citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:6fdae4fb465da9491b8290ba16c2f88fa679cea6af0486912c9d770bd273cdae","observation_id":"6e600833-0be1-47ec-ae0b-6e41b528d5df","resolution":{"observed_at":"2026-08-11T14:35:02.612977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00877","last_updated":"2024-06-02T21:57:32Z","snapshot_observed_at":"2026-08-12T23:52:03.444117Z","submitted_at":"2024-06-02T21:57:32Z","title":"Evidence of Learned Look-Ahead in a Chess-Playing Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00877","snapshot_observed_at":"2026-08-11T14:35:02.251568Z","title":"Erik Jenner, Shreyas Kapur, Vasil Georgiev, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.251568Z"},"links":{"cited_paper":"/paper/2406.00877","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:12ad4bba346b1e39b4167dcf82ed8f8afb5db8fe0832546d3fc7821e49d1e571","observation_id":"2fbfb1a6-0ec6-43c2-852e-4c3c43cd9f9a","resolution":{"observed_at":"2026-08-11T14:35:02.251568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:35:02.661148Z","title":"Anthropic circuits Updates - January 2024, Jan- uary","venue":null,"work_id":"44407a0a-0723-4218-8108-20e3c05908d8","year":2024},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.256398Z"},"links":{"citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:562d1b2f36611b5e2f44a8a96ce1605fd8ac283747144b904d83582da9b114a4","observation_id":"74d95881-dbef-4728-9b18-037837a381a6","resolution":{"observed_at":"2026-08-11T14:35:02.665287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15498","last_updated":"2024-07-14T20:23:19Z","snapshot_observed_at":"2026-08-13T00:48:22.560549Z","submitted_at":"2024-03-21T18:53:23Z","title":"Emergent World Models and Latent Variable Estimation in Chess-Playing Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.15498","snapshot_observed_at":"2026-08-11T14:35:02.260686Z","title":"Adam Karvonen","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.260686Z"},"links":{"cited_paper":"/paper/2403.15498","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:62d6e33a2d3e5b9436a67b051fd57a10e793b7f88c43297407da30269cec2b0f","observation_id":"b86b0fd5-d3c7-4d0a-83af-ce31c2c8ed5a","resolution":{"observed_at":"2026-08-11T14:35:02.260686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00113","last_updated":"2024-10-30T14:21:59Z","snapshot_observed_at":"2026-08-12T23:10:43.877749Z","submitted_at":"2024-07-31T18:45:13Z","title":"Measuring Progress in Dictionary Learning for Language Model Interpretability with Board Game Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00113","snapshot_observed_at":"2026-08-11T14:35:02.265630Z","title":"Measuring progress in dictionary learning for language model interpretability with board game models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.265630Z"},"links":{"cited_paper":"/paper/2408.00113","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:1a2f4fb732ad0c5e8f11e29e9f6b43fc7d191e9342fb9203ef91086c033e6789","observation_id":"fe097f5d-d18e-4551-a47e-89f0af4336ac","resolution":{"observed_at":"2026-08-11T14:35:02.265630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13382","last_updated":"2024-06-26T14:27:49Z","snapshot_observed_at":"2026-08-09T03:25:38.596456Z","submitted_at":"2022-10-24T16:29:55Z","title":"Emergent World Representations: Exploring a Sequence Model Trained on a Synthetic Task","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13382","snapshot_observed_at":"2026-08-11T14:35:02.270102Z","title":"Emergent world representations: Exploring a sequence model trained on a synthetic task","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.270102Z"},"links":{"cited_paper":"/paper/2210.13382","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:da8f4d634fa28e4e7e44d94c5cfe535c75e39c5a0b0c91724a5cc2d13daf3f70","observation_id":"ffa14660-9086-4895-a091-95d0c089fc04","resolution":{"observed_at":"2026-08-11T14:35:02.270102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09458","last_updated":"2023-07-24T08:32:40Z","snapshot_observed_at":"2026-07-06T15:55:28.974661Z","submitted_at":"2023-07-18T17:39:04Z","title":"Does Circuit Analysis Interpretability Scale? Evidence from Multiple Choice Capabilities in Chinchilla","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09458","snapshot_observed_at":"2026-08-11T14:35:02.274512Z","title":"Does Circuit Analysis Interpretability Scale? Evidence from Multiple Choice Capabilities in Chinchilla","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.274512Z"},"links":{"cited_paper":"/paper/2307.09458","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:731693686787cda252d8004f6dce6d854a9c72f04d6985b2b25407156f4c4f23","observation_id":"d7358571-6f56-4511-93e4-2986f1dc8bc3","resolution":{"observed_at":"2026-08-11T14:35:02.274512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03207","last_updated":"2024-05-06T07:12:45Z","snapshot_observed_at":"2026-08-13T00:14:15.913645Z","submitted_at":"2024-05-06T07:12:45Z","title":"A Philosophical Introduction to Language Models - Part II: The Way Forward","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03207","snapshot_observed_at":"2026-08-11T14:35:02.278670Z","title":"Ida Momennejad, Hosein Hasanbeig, Felipe Vieira Frujeri, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.278670Z"},"links":{"cited_paper":"/paper/2405.03207","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:123c4525b47f673274d2631fb85c181b3fc35cbe2bd30b825270c9f5c7d68eb8","observation_id":"ce172b65-e52a-4973-9810-58cf95fd697f","resolution":{"observed_at":"2026-08-11T14:35:02.278670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-08-11T14:35:02.282864Z","title":"In-context Learning and Induction Hea ds","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.282864Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:e49178bf53859489cb35f3a36e27a3749e5ccd0a0ce7ce333788dfaffc867059","observation_id":"860adedc-0d51-4d48-b774-b659bcaf6d71","resolution":{"observed_at":"2026-08-11T14:35:02.282864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04897","last_updated":"2023-11-08T18:56:35Z","snapshot_observed_at":"2026-08-06T05:52:56.931849Z","submitted_at":"2023-11-08T18:56:35Z","title":"Future Lens: Anticipating Subsequent Tokens from a Single Hidden State","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04897","snapshot_observed_at":"2026-08-11T14:35:02.287451Z","title":"Future lens: Anticipating subsequent tokens from a single hidden state","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.287451Z"},"links":{"cited_paper":"/paper/2311.04897","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:913f924a873c8d0b925b3f1f8ddf789e5c95b50c3be352c68122480b24faa3af","observation_id":"fb3f64f0-6dc3-4956-ac65-ca8c7665e917","resolution":{"observed_at":"2026-08-11T14:35:02.287451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:35:02.647347Z","title":"Toward Transparent AI: A Survey on Interpreting the Inner Structures of Deep Neural Networks","venue":null,"work_id":"9f57fb4c-5b0c-4bc9-b9aa-6148748f4270","year":2023},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.291900Z"},"links":{"citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:375c0f4af3250fe9861edad445fa87ecb72bdadc2c48070e30d12fb48831e387","observation_id":"f57ce243-8517-4410-aa13-d050866bb63f","resolution":{"observed_at":"2026-08-11T14:35:02.652386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.07512","last_updated":"2022-07-15T14:57:33Z","snapshot_observed_at":"2026-08-03T23:43:48.661235Z","submitted_at":"2022-07-15T14:57:33Z","title":"Sparse Relational Reasoning with Object-Centric Representations","version":1},"cited_work":{"arxiv_id":"2207.07512","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.07512","snapshot_observed_at":"2026-08-11T14:35:02.354938Z","title":"Sparse Relational Reasoning with Object-Centric Representations","venue":"cs.LG","work_id":"9c8ff4f3-0352-41b9-947e-5e017dd32cd0","year":2022},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.295539Z"},"links":{"cited_paper":"/paper/2207.07512","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:8f39bf7504e2e81cc7bcff2dad7ac3498adac465a24d3d209cc5fb99b90c12c9","observation_id":"abb4c6b7-46f6-45ca-9ccb-059987e141d5","resolution":{"observed_at":"2026-08-11T14:35:02.361877Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:35:02.595908Z","title":"16 Published as a conference paper at ICLR 2025 0 1 2 3 4 Maze X 4 3 2 1 0Maze Y 95% (1798,","venue":null,"work_id":"44cdfd3e-bb66-4cec-8f40-29fbeffa8dd9","year":2025},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.312621Z"},"links":{"citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:e531908d9ea3dd40e429c5754fea81a910704ebe9cb3c1ca03804b8f2f943bb5","observation_id":"49894076-1b22-4827-b887-1abb20e781a6","resolution":{"observed_at":"2026-08-11T14:35:02.600405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:35:02.569581Z","title":"generic edge","venue":null,"work_id":"1f70a11d-6b1c-4a14-9d22-9d35698d0e01","year":2025},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.320784Z"},"links":{"citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:e4c032694f8170a917ae1a661b83d2593129bc8c9a1aca5dfac2674edb4fd76c","observation_id":"8cf25f77-76e5-4a1c-b50f-a9f95ebb3eb5","resolution":{"observed_at":"2026-08-11T14:35:02.573839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:35:02.582862Z","title":null,"venue":null,"work_id":"5243fb9b-f472-4447-9e0f-b611596a0933","year":2025},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":1619,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.316637Z"},"links":{"citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:681814e07935b3a32b68b2d1b87c6ebecdf7ffcc7d8eeeacbf3db0f8e07fc30a","observation_id":"6cd74cfd-3c54-44fc-97c0-c9bed4e904db","resolution":{"observed_at":"2026-08-11T14:35:02.587225Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08112","last_updated":"2025-11-11T01:13:28Z","snapshot_observed_at":"2026-08-12T19:18:05.160367Z","submitted_at":"2023-03-14T17:47:09Z","title":"Eliciting Latent Predictions from Transformers with the Tuned Lens","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08112","snapshot_observed_at":"2026-08-11T14:35:02.219578Z","title":"Eliciting Latent Predictions from Transformers with the Tuned Lens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.219578Z"},"links":{"cited_paper":"/paper/2303.08112","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:f68527e71d4a771099088f191659ca568de258377f287d4946293eb4733e647f","observation_id":"4cb9fc3c-d98d-4eaa-8267-4c3a2d95d717","resolution":{"observed_at":"2026-08-11T14:35:02.219578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:35:02.634309Z","title":"Train Val","venue":null,"work_id":"93dea119-b1eb-43e1-be56-5bc4855451de","year":2025},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.299935Z"},"links":{"citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:7f8d9466f13ebb52d43536fa83d3be2feee04191a36ec56f115f05d04189dc1a","observation_id":"0316d28b-0e31-4bc5-86fb-a7e79b944b80","resolution":{"observed_at":"2026-08-11T14:35:02.638475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10498","last_updated":"2023-10-24T21:42:01Z","snapshot_observed_at":"2026-08-12T05:55:37.216892Z","submitted_at":"2023-09-19T10:20:11Z","title":"A Configurable Library for Generating and Manipulating Maze Datasets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10498","snapshot_observed_at":"2026-08-11T14:35:02.247220Z","title":"Ivanitskiy, Rusheb Shah, Alex F Spies, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.247220Z"},"links":{"cited_paper":"/paper/2309.10498","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:da3c416a68dc62ffd6eb7b3d4cf2f5fd7df8a2752c4bf81e3d185c974b762e97","observation_id":"c8627dc5-4146-435b-83a8-1f641af29e63","resolution":{"observed_at":"2026-08-11T14:35:02.247220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10652","last_updated":"2022-09-21T20:49:26Z","snapshot_observed_at":"2026-07-06T13:54:56.779166Z","submitted_at":"2022-09-21T20:49:26Z","title":"Toy Models of Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10652","snapshot_observed_at":"2026-08-11T14:35:02.233057Z","title":"Nelson Elhage, Tristan Hume, Catherine Olsson, et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.233057Z"},"links":{"cited_paper":"/paper/2209.10652","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:95074fe5fb885ee508e8c18b7305471b0c71ec21158e3b703ad3b41a1d0ef47c","observation_id":"cfddd630-c145-45ea-8d31-0c8dac448b06","resolution":{"observed_at":"2026-08-11T14:35:02.233057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12201","last_updated":"2024-02-19T15:04:53Z","snapshot_observed_at":"2026-08-11T00:13:50.706758Z","submitted_at":"2024-02-19T15:04:53Z","title":"Dictionary Learning Improves Patch-Free Circuit Discovery in Mechanistic Interpretability: A Case Study on Othello-GPT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12201","snapshot_observed_at":"2026-08-11T14:35:02.237878Z","title":"Dictionary learning improves patch-free circuit discov- ery in mechanistic interpretability: A case study on othello-gpt.arXiv preprint arXiv:2402.12201,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.237878Z"},"links":{"cited_paper":"/paper/2402.12201","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:f2c11c6578604d36bd11340773fb34d1e3fb20d7a82417d76a922c76607372a5","observation_id":"44d25516-9f58-4091-bed9-8d8c97c6f7fe","resolution":{"observed_at":"2026-08-11T14:35:02.237878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11917","last_updated":"2024-06-30T00:52:49Z","snapshot_observed_at":"2026-08-07T11:08:47.977754Z","submitted_at":"2024-02-19T08:04:25Z","title":"A Mechanistic Analysis of a Transformer Trained on a Symbolic Multi-Step Reasoning Task","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11917","snapshot_observed_at":"2026-08-11T14:35:02.224040Z","title":"Jannik Brinkmann, Abhay Sheshadri, Victor Levoso, et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.224040Z"},"links":{"cited_paper":"/paper/2402.11917","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:50d53d84502a2cd488ad1a745f8b13fe85c48f31106407c607a307b06d9dac17","observation_id":"8c358437-31b3-4607-8bbc-1ad78d6c1e84","resolution":{"observed_at":"2026-08-11T14:35:02.224040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:35:02.673792Z","title":"A structural probe for finding syntax in word representa- tions","venue":null,"work_id":"87d52b0c-f5f7-4051-8b83-affeda92f298","year":2019},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.242749Z"},"links":{"citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:874fde561f0a7c04bdc03cd0b059eb633132b13d96986d4b70caebfea984056c","observation_id":"580dea35-582c-4dfc-84fb-23ca7e1bf622","resolution":{"observed_at":"2026-08-11T14:35:02.677759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 3 inbound Pith citation observations for arXiv:2412.11867."}