{"as_of":"2026-08-23T07:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d39963312154aee322bac70e4fce0024b8335b92c1813820255a2eec5490e2d7","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":35,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:44:55.426570Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":"2403.00745","doi":"10.48550/arxiv.2403.00745","metadata_source":"pith","pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":"cs.LG","work_id":"bcf1c2ba-c8b4-4bff-a898-7046eeac4b3f","year":2024},"citing_paper":{"arxiv_id":"2403.19647","last_updated":"2025-03-27T05:44:45Z","snapshot_observed_at":"2026-08-14T07:35:01.333549Z","submitted_at":"2024-03-28T17:56:07Z","title":"Sparse Feature Circuits: Discovering and Editing Interpretable Causal Graphs in Language Models","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-13T13:15:10.632115Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2403.19647"},"observation_digest":"sha256:b43bcdb82d05dc376b91b219a47d497fcfc3bbfafc0b6c74c5091bd5dc653133","observation_id":"cb6c96a8-3327-4d2b-8554-8db5b559bc76","resolution":{"observed_at":"2026-05-13T13:15:10.715282Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-12T21:29:17.070133Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08745","last_updated":"2025-06-25T15:16:54Z","snapshot_observed_at":"2026-08-15T05:59:56.967499Z","submitted_at":"2024-11-13T16:26:19Z","title":"Separating Tongue from Thought: Activation Patching Reveals Language-Agnostic Concept Representations in Transformers","version":4},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T21:29:17.070133Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2411.08745"},"observation_digest":"sha256:5520adb29d78383c83d7da1b29df1dded7d5062fad9fe71ef5a29c6421fdf630","observation_id":"a9fc4b30-04b2-4085-9193-6378f20f8b78","resolution":{"observed_at":"2026-08-12T21:29:17.070133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-10T20:26:42.874194Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08618","last_updated":"2025-01-15T06:34:34Z","snapshot_observed_at":"2026-08-14T07:35:37.952253Z","submitted_at":"2025-01-15T06:34:34Z","title":"Disjoint Processing Mechanisms of Hierarchical and Linear Grammars in Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T20:26:42.874194Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2501.08618"},"observation_digest":"sha256:103752e723c9fa31055f6669e1e78954a54b29b37728449a14396f2bb88fe1e4","observation_id":"3476cbbb-24e0-4dfd-9492-ed5e5f5c9ffd","resolution":{"observed_at":"2026-08-10T20:26:42.874194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-10T14:55:02.076326Z","title":"Atp*: An efficient and scalable method for localizing llm behaviour to components, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-18T04:36:12.878322Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.076326Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:bcf098baa96a3eeaf5be734eb435b2362b45dfa54f7cfa3a7c4194114b8f5667","observation_id":"4dc3b048-ff07-46d0-b532-91eb721ae6a2","resolution":{"observed_at":"2026-08-10T14:55:02.076326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-09T17:58:34.935332Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00726","last_updated":"2025-02-02T09:15:27Z","snapshot_observed_at":"2026-08-13T16:36:49.694606Z","submitted_at":"2025-02-02T09:15:27Z","title":"Perspectives for Direct Interpretability in Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-09T17:58:34.935332Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2502.00726"},"observation_digest":"sha256:3662261fb36167f51e1043528f515f667dc70624fcc6839bf56e2b2cf248fec4","observation_id":"1feee041-aced-46ba-90f2-5eef86974bed","resolution":{"observed_at":"2026-08-09T17:58:34.935332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-09T17:29:00.164619Z","title":"Atp*: An efficient and scalable method for localizing llm behaviour to components, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00873","last_updated":"2025-02-02T18:55:26Z","snapshot_observed_at":"2026-08-17T22:25:22.595447Z","submitted_at":"2025-02-02T18:55:26Z","title":"Language Models Use Trigonometry to Do Addition","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T17:29:00.164619Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2502.00873"},"observation_digest":"sha256:21e71c6f8ee681b0507251c3d42c71c3db7e7140a15b225f7f74098f039ea003","observation_id":"61541782-adb1-407b-872e-f46ea5afb7cc","resolution":{"observed_at":"2026-08-09T17:29:00.164619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-07T12:35:38.272914Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24731","last_updated":"2025-05-30T15:53:56Z","snapshot_observed_at":"2026-08-16T09:04:15.874605Z","submitted_at":"2025-05-30T15:53:56Z","title":"Circuit Stability Characterizes Language Model Generalization","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:38.272914Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2505.24731"},"observation_digest":"sha256:f7bacadcc3d8cf2c466e8c7250981268301ef5f827b6cabbe1e7a6bf533a9c7b","observation_id":"178e618b-1e7b-4d39-bdf7-12e5b6a543dc","resolution":{"observed_at":"2026-08-07T12:35:38.272914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-07T10:24:26.388763Z","title":"InInternational Conference on Learning Representations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05451","last_updated":"2025-06-05T17:56:05Z","snapshot_observed_at":"2026-08-15T21:12:10.172980Z","submitted_at":"2025-06-05T17:56:05Z","title":"Interpretation Meets Safety: A Survey on Interpretation Methods and Tools for Improving LLM Safety","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T10:24:26.388763Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2506.05451"},"observation_digest":"sha256:a491bfbc500c56efcaa40483e0808673a3bac71e06efdbaf0001787e4b7898f7","observation_id":"1215c80c-f397-4304-89cd-3a2e21d794a6","resolution":{"observed_at":"2026-08-07T10:24:26.388763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-15T18:44:55.426570Z","title":"Naveen Krishnan","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18887","last_updated":"2025-06-23T17:56:34Z","snapshot_observed_at":"2026-08-21T10:07:18.792584Z","submitted_at":"2025-06-23T17:56:34Z","title":"Steering Conceptual Bias via Transformer Latent-Subspace Activation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:55.426570Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2506.18887"},"observation_digest":"sha256:76fc6754c754f8f582866b53c5faad37af8d73455a7273abd1c2deef5644c53a","observation_id":"e4c63bfe-0596-4ab6-bba2-962ba17708a8","resolution":{"observed_at":"2026-08-15T18:44:55.426570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-06T22:48:37.292501Z","title":"Atp*: An efficient and scalable method for localizing llm behaviour to components, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20790","last_updated":"2025-09-04T11:41:34Z","snapshot_observed_at":"2026-08-14T18:44:49.766181Z","submitted_at":"2025-06-25T19:26:31Z","title":"Stochastic Parameter Decomposition","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T22:48:37.292501Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2506.20790"},"observation_digest":"sha256:d6f03e46b54d5d1e75dbd6a43cf426b47b41b1378879e77cb0a99d764e468f52","observation_id":"730a5abb-3bfe-4ef2-9158-8b517b1b6833","resolution":{"observed_at":"2026-08-06T22:48:37.292501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-06T19:10:28.998137Z","title":"Kramár, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06445","last_updated":"2026-07-21T16:59:32Z","snapshot_observed_at":"2026-08-18T18:34:24.314623Z","submitted_at":"2025-07-08T23:07:33Z","title":"Can Interpretation Predict Behavior on Unseen Data?","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:10:28.998137Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2507.06445"},"observation_digest":"sha256:4a4a995ebf6e79e3d1620d85805c1a8a3a4ed002c32bcb59406191188ae8cfde","observation_id":"985b5627-8aaa-47aa-9bd3-5ba6ef2d94fe","resolution":{"observed_at":"2026-08-06T19:10:28.998137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T17:37:55.128637Z","title":"Atp*: An efficient and scalable method for localizing llm behaviour to components, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.16109","last_updated":"2025-08-22T05:54:11Z","snapshot_observed_at":"2026-08-11T21:09:52.797279Z","submitted_at":"2025-08-22T05:54:11Z","title":"From Indirect Object Identification to Syllogisms: Exploring Binary Mechanisms in Transformer Circuits","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T17:37:55.128637Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2508.16109"},"observation_digest":"sha256:5467e0195d6365181f47062f77dee1353200549d86784da679d51d51992afc03","observation_id":"75fe8a39-8c9d-4395-a5d8-e911148a90ba","resolution":{"observed_at":"2026-08-05T17:37:55.128637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":"2403.00745","doi":"10.48550/arxiv.2403.00745","metadata_source":"pith","pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":"cs.LG","work_id":"bcf1c2ba-c8b4-4bff-a898-7046eeac4b3f","year":2024},"citing_paper":{"arxiv_id":"2604.08016","last_updated":"2026-04-23T16:14:56Z","snapshot_observed_at":"2026-08-20T11:22:38.776705Z","submitted_at":"2026-04-09T09:16:00Z","title":"Wiring the 'Why': A Unified Taxonomy and Survey of Abductive Reasoning in LLMs","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-10T17:57:23.282052Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2604.08016"},"observation_digest":"sha256:163c3a4ebfa20e8a3f44979a764c8ec834d3afb7e6d19e9d6b7eaf481d11d0f3","observation_id":"55e5023d-d217-4135-b3f4-dfb4296ce340","resolution":{"observed_at":"2026-05-11T05:46:09.779273Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":"2403.00745","doi":"10.48550/arxiv.2403.00745","metadata_source":"pith","pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":"cs.LG","work_id":"bcf1c2ba-c8b4-4bff-a898-7046eeac4b3f","year":2024},"citing_paper":{"arxiv_id":"2604.13694","last_updated":"2026-04-15T10:21:38Z","snapshot_observed_at":"2026-08-15T14:10:30.120063Z","submitted_at":"2026-04-15T10:21:38Z","title":"Weight Patching: Toward Source-Level Mechanistic Localization in LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T13:31:36.370422Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2604.13694"},"observation_digest":"sha256:0a19ecd91db0bcb826f23e3fa95bbf63c78bc0dd6a7f4c49a812c4e45d4482c1","observation_id":"b7172ed3-f045-4d23-963d-bba7affc696b","resolution":{"observed_at":"2026-05-10T13:35:26.506038Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":"2403.00745","doi":"10.48550/arxiv.2403.00745","metadata_source":"pith","pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":"cs.LG","work_id":"bcf1c2ba-c8b4-4bff-a898-7046eeac4b3f","year":2024},"citing_paper":{"arxiv_id":"2604.19052","last_updated":"2026-04-21T03:58:47Z","snapshot_observed_at":"2026-08-15T04:37:54.683532Z","submitted_at":"2026-04-21T03:58:47Z","title":"Cell-Based Representation of Relational Binding in Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-10T02:21:04.591556Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2604.19052"},"observation_digest":"sha256:a6b5944491ac91861021cdb85f26cf44c2ba44d558cb3c6bf5c0d542ebb18543","observation_id":"ef1a1761-b1f8-49dd-859b-44b974575a16","resolution":{"observed_at":"2026-05-11T13:06:04.689930Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":"2403.00745","doi":"10.48550/arxiv.2403.00745","metadata_source":"pith","pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":"cs.LG","work_id":"bcf1c2ba-c8b4-4bff-a898-7046eeac4b3f","year":2024},"citing_paper":{"arxiv_id":"2605.08740","last_updated":"2026-05-09T07:05:26Z","snapshot_observed_at":"2026-08-13T01:14:22.122054Z","submitted_at":"2026-05-09T07:05:26Z","title":"Causal Dimensionality of Transformer Representations: Measurement, Scaling, and Layer Structure","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-12T03:18:06.199430Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2605.08740"},"observation_digest":"sha256:34218bef6e03874424305278433649a357abbfaccb36ebcfd4f463003c04d517","observation_id":"af8e2676-9e65-4045-80f5-1b3dee73b568","resolution":{"observed_at":"2026-05-12T03:21:19.001882Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":"2403.00745","doi":"10.48550/arxiv.2403.00745","metadata_source":"pith","pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":"cs.LG","work_id":"bcf1c2ba-c8b4-4bff-a898-7046eeac4b3f","year":2024},"citing_paper":{"arxiv_id":"2605.09314","last_updated":"2026-05-10T04:15:24Z","snapshot_observed_at":"2026-08-12T15:15:52.933479Z","submitted_at":"2026-05-10T04:15:24Z","title":"How LLMs Are Persuaded: A Few Attention Heads, Rerouted","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-12T04:18:09.600353Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2605.09314"},"observation_digest":"sha256:6fca4e08ed02f14b478c734ed97e838d18a376d33c6a66b5c8e3c59e983914b8","observation_id":"60b445b2-3634-42d4-8bd6-3db03aa0f56d","resolution":{"observed_at":"2026-05-12T06:26:24.280719Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":"2403.00745","doi":"10.48550/arxiv.2403.00745","metadata_source":"pith","pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":"cs.LG","work_id":"bcf1c2ba-c8b4-4bff-a898-7046eeac4b3f","year":2024},"citing_paper":{"arxiv_id":"2605.12207","last_updated":"2026-05-12T14:46:00Z","snapshot_observed_at":"2026-08-18T15:19:20.161895Z","submitted_at":"2026-05-12T14:46:00Z","title":"Not How Many, But Which: Parameter Placement in Low-Rank Adaptation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-13T06:13:55.497799Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2605.12207"},"observation_digest":"sha256:b57d03b81c40bc5cdb0589df3a620f3a8f221fbcc14a3ea0204b76eaf2d0e953","observation_id":"5a01933e-9258-4752-82aa-db9a0d792ccd","resolution":{"observed_at":"2026-05-13T06:17:23.202341Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":"2403.00745","doi":"10.48550/arxiv.2403.00745","metadata_source":"pith","pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":"cs.LG","work_id":"bcf1c2ba-c8b4-4bff-a898-7046eeac4b3f","year":2024},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-14T20:53:40.666929Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:c7be1af67328be07adf4cb4affddd0b8fa43b632009b140521a45a8796656c16","observation_id":"ed325fa1-5b59-4798-bcc5-af82bdf3da05","resolution":{"observed_at":"2026-05-14T20:59:28.809227Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":"2403.00745","doi":"10.48550/arxiv.2403.00745","metadata_source":"pith","pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":"cs.LG","work_id":"bcf1c2ba-c8b4-4bff-a898-7046eeac4b3f","year":2024},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-15T04:59:11.877068Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:d1b4ac62881b0d608592ff0dbd32ff2ce537899c9f662c112f4f00a80881a706","observation_id":"9b3f5625-0118-460a-a276-7614e5b53e05","resolution":{"observed_at":"2026-05-15T04:59:45.276290Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":"2403.00745","doi":"10.48550/arxiv.2403.00745","metadata_source":"pith","pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":"cs.LG","work_id":"bcf1c2ba-c8b4-4bff-a898-7046eeac4b3f","year":2024},"citing_paper":{"arxiv_id":"2605.24577","last_updated":"2026-05-23T13:37:59Z","snapshot_observed_at":"2026-08-06T00:55:19.919445Z","submitted_at":"2026-05-23T13:37:59Z","title":"Polymorphism Is Rotation: Operational Mechanistic Interpretability from a Two-Layer Transformer to Pythia-70m","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T14:10:42.640805Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2605.24577"},"observation_digest":"sha256:ee065cb254cdc053692f05dc1c6efbcebd31ef45aa85496d08a0474c6eb1d038","observation_id":"3b120abc-9cfa-44c0-b74b-86b5886ac5a6","resolution":{"observed_at":"2026-06-30T14:14:45.528877Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":"2403.00745","doi":"10.48550/arxiv.2403.00745","metadata_source":"pith","pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":"cs.LG","work_id":"bcf1c2ba-c8b4-4bff-a898-7046eeac4b3f","year":2024},"citing_paper":{"arxiv_id":"2605.25225","last_updated":"2026-06-11T16:48:48Z","snapshot_observed_at":"2026-08-15T08:57:37.558326Z","submitted_at":"2026-05-24T19:26:25Z","title":"Transformer Field Theory: A Response-Theoretic Approach to Mechanistic Interpretability","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T11:58:53.868902Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2605.25225"},"observation_digest":"sha256:cf6caf6509a1a1e729c9ac63e9dc02a0f02600476c2c913796e34b8b0c29a8a4","observation_id":"4fbca113-87b9-49e8-b0ef-13689a794349","resolution":{"observed_at":"2026-06-30T12:04:38.232924Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":"2403.00745","doi":"10.48550/arxiv.2403.00745","metadata_source":"pith","pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":"cs.LG","work_id":"bcf1c2ba-c8b4-4bff-a898-7046eeac4b3f","year":2024},"citing_paper":{"arxiv_id":"2605.29358","last_updated":"2026-05-28T04:57:47Z","snapshot_observed_at":"2026-08-13T14:53:56.384009Z","submitted_at":"2026-05-28T04:57:47Z","title":"Scaling Monosemanticity: Extracting Interpretable Features from Claude 3 Sonnet","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:04.813379Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2605.29358"},"observation_digest":"sha256:cbdf8140c0f866bb46a1b9bb28e97d7301587e6a16b8c7e5fd929cd646497356","observation_id":"20f6d7b7-97b2-4622-8e0b-86c688ee4fb0","resolution":{"observed_at":"2026-06-29T07:53:13.422088Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":"2403.00745","doi":"10.48550/arxiv.2403.00745","metadata_source":"pith","pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":"cs.LG","work_id":"bcf1c2ba-c8b4-4bff-a898-7046eeac4b3f","year":2024},"citing_paper":{"arxiv_id":"2606.00831","last_updated":"2026-05-30T18:05:35Z","snapshot_observed_at":"2026-07-06T23:41:30.158879Z","submitted_at":"2026-05-30T18:05:35Z","title":"Subliminal Learning is a LoRA Artifact","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-28T18:28:42.513733Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2606.00831"},"observation_digest":"sha256:d02f752473935d23e1834becdd9106b542aace436393f1290c107ed9f26e9916","observation_id":"dfbe8c23-2036-40e9-bb70-a153aefae165","resolution":{"observed_at":"2026-06-28T20:42:37.588014Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":"2403.00745","doi":"10.48550/arxiv.2403.00745","metadata_source":"pith","pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":"cs.LG","work_id":"bcf1c2ba-c8b4-4bff-a898-7046eeac4b3f","year":2024},"citing_paper":{"arxiv_id":"2606.06267","last_updated":"2026-06-04T15:10:14Z","snapshot_observed_at":"2026-08-02T02:21:26.909548Z","submitted_at":"2026-06-04T15:10:14Z","title":"Many Circuits, One Mechanism: Input Variation and Evaluation Granularity in Circuit Discovery","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-06-28T01:48:12.958931Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2606.06267"},"observation_digest":"sha256:892803266855afa4864a33f14866cc181c955af14f844ffb8da46cd8a3361477","observation_id":"798b7c1b-5a32-4a70-8b18-838af695c2a5","resolution":{"observed_at":"2026-06-28T01:51:28.966057Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":"2403.00745","doi":"10.48550/arxiv.2403.00745","metadata_source":"pith","pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":"cs.LG","work_id":"bcf1c2ba-c8b4-4bff-a898-7046eeac4b3f","year":2024},"citing_paper":{"arxiv_id":"2606.08044","last_updated":"2026-08-04T12:50:00Z","snapshot_observed_at":"2026-08-07T23:11:38.433528Z","submitted_at":"2026-06-06T08:10:56Z","title":"When Behavioral Safety Evaluation Fails: A Representation-Level Perspective","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-27T20:04:17.744876Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2606.08044"},"observation_digest":"sha256:a0d1c96c14235b115c84bf1f18ab4135a829cb7b79b784446df30233253a80da","observation_id":"65472b2b-5d9b-42d9-890d-f62ae5d12c07","resolution":{"observed_at":"2026-07-02T20:57:23.086842Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":"2403.00745","doi":"10.48550/arxiv.2403.00745","metadata_source":"pith","pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":"cs.LG","work_id":"bcf1c2ba-c8b4-4bff-a898-7046eeac4b3f","year":2024},"citing_paper":{"arxiv_id":"2606.09899","last_updated":"2026-06-05T05:20:32Z","snapshot_observed_at":"2026-08-13T06:05:22.013435Z","submitted_at":"2026-06-05T05:20:32Z","title":"When Attribution Patching Lies: Diagnosis and a Second-Order Correction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T22:58:46.335785Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2606.09899"},"observation_digest":"sha256:25dfe48483aa7d1e7466adc2cfc76d783a10612ed3eddcbc709386fba79cd37f","observation_id":"2997d91a-32dc-4312-91a4-75a6063e6f3c","resolution":{"observed_at":"2026-07-02T16:07:09.056752Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":"2403.00745","doi":"10.48550/arxiv.2403.00745","metadata_source":"pith","pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":"cs.LG","work_id":"bcf1c2ba-c8b4-4bff-a898-7046eeac4b3f","year":2024},"citing_paper":{"arxiv_id":"2606.12818","last_updated":"2026-06-11T02:28:16Z","snapshot_observed_at":"2026-08-17T16:00:21.142033Z","submitted_at":"2026-06-11T02:28:16Z","title":"Localizing Anchoring Pathways in Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T07:04:57.016552Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2606.12818"},"observation_digest":"sha256:b09c68384d695383072c38b2c7be151aa99fe0799bce4288a9890411b750ac8d","observation_id":"a03226b5-68db-4d60-8ba7-6a5d3d399e43","resolution":{"observed_at":"2026-07-03T14:28:31.353144Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":"2403.00745","doi":"10.48550/arxiv.2403.00745","metadata_source":"pith","pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":"cs.LG","work_id":"bcf1c2ba-c8b4-4bff-a898-7046eeac4b3f","year":2024},"citing_paper":{"arxiv_id":"2606.20678","last_updated":"2026-06-12T23:31:52Z","snapshot_observed_at":"2026-08-13T21:09:13.364756Z","submitted_at":"2026-06-12T23:31:52Z","title":"Beyond Importance: Interchange-Sobol Sensitivity Reveals Task-Specific Content Channels in Transformer Components","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-27T04:04:58.151452Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2606.20678"},"observation_digest":"sha256:9242978e78417b7cebab33dbc613ca518f4bc8e94274ca9108a1fca6aa63debe","observation_id":"313d37f0-6013-4bd7-abb9-11a3ac5410bc","resolution":{"observed_at":"2026-07-03T17:28:44.697122Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":"2403.00745","doi":"10.48550/arxiv.2403.00745","metadata_source":"pith","pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":"cs.LG","work_id":"bcf1c2ba-c8b4-4bff-a898-7046eeac4b3f","year":2024},"citing_paper":{"arxiv_id":"2607.08349","last_updated":"2026-07-09T10:55:04Z","snapshot_observed_at":"2026-08-16T02:03:23.036860Z","submitted_at":"2026-07-09T10:55:04Z","title":"Certified Interventional Fidelity: Anytime-Valid, Adaptive Evaluation of Causal Claims in Mechanistic Interpretability","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-10T08:57:40.864338Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2607.08349"},"observation_digest":"sha256:accc74018ce1f38334cb51c3cfbafdbab902c219c8ede4f056920594d2c1146a","observation_id":"cf7af405-a3e5-4ff6-b25e-517c8c9f69e7","resolution":{"observed_at":"2026-07-10T09:06:59.176399Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:10.720148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-01T23:15:27.600435Z","title":"Atp*: An efficient and scalable method for localizing llm behaviour to components.arXiv preprint arXiv:2403.00745, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15495","last_updated":"2026-07-16T22:54:30Z","snapshot_observed_at":"2026-08-19T09:54:53.193795Z","submitted_at":"2026-07-16T22:54:30Z","title":"Verbalizable Representations Form a Global Workspace in Language Models","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-01T23:15:27.600435Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2607.15495"},"observation_digest":"sha256:67e4b4c6201c063ca753a72f03310383ad9911fa352e470ea0120ef15c80ca99","observation_id":"92b12914-ff66-4388-b3c1-3292c675f2f1","resolution":{"observed_at":"2026-08-01T23:15:27.600435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-01T14:03:18.016818Z","title":"AtP* : An efficient and scalable method for localizing LLM behaviour to components","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18921","last_updated":"2026-07-21T10:04:29Z","snapshot_observed_at":"2026-08-15T08:37:36.948706Z","submitted_at":"2026-07-21T10:04:29Z","title":"Circuit Claims Depend on What Is Extracted and How It Is Compared","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T14:03:18.016818Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2607.18921"},"observation_digest":"sha256:c1043c44af910201ee6e7addc2baac1677683e5936052d668dbd77072c89f05e","observation_id":"529e8a8c-b88a-4f1f-ba12-4ab4cd46af65","resolution":{"observed_at":"2026-08-01T14:03:18.016818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-12T00:23:26.696774Z","title":"arXiv preprint arXiv:2403.00745 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08224","last_updated":"2026-08-08T16:44:47Z","snapshot_observed_at":"2026-08-17T04:54:20.469219Z","submitted_at":"2026-08-08T16:44:47Z","title":"Control-Diverse Reinforcement Fine-Tuning: Decoupling the Shared Control Bottleneck of RL Post-Training","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T00:23:26.696774Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2608.08224"},"observation_digest":"sha256:a4c3a867a2d59f82e5053c26afe7511df98f11aa8b7e251c4fb8f5ef1c3c2b75","observation_id":"99ffb5c0-1972-4a93-9f01-27fb72ec9e53","resolution":{"observed_at":"2026-08-12T00:23:26.696774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-14T04:21:09.465395Z","title":"AtP⋆: An efficient and scalable method for lo- calizing LLM behaviour to components.arXiv preprint arXiv:2403.00745, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10172","last_updated":"2026-08-10T19:42:01Z","snapshot_observed_at":"2026-08-17T07:01:29.715682Z","submitted_at":"2026-08-10T19:42:01Z","title":"Intrinsic Structure: Spectral Identifiability for Mechanistic Interpretability","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T04:21:09.465395Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2608.10172"},"observation_digest":"sha256:56f0ee3d9114526e2be62bb728d08090eeba57f0f78d4b12d43ab947a2637926","observation_id":"74cab79d-a110-4087-b37f-9a423274db9a","resolution":{"observed_at":"2026-08-14T04:21:09.465395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-14T13:29:00.188391Z","title":"Atp*: An efficient and scalable method for localizing llm behaviour to components","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13337","last_updated":"2026-08-13T15:06:56Z","snapshot_observed_at":"2026-08-19T08:41:50.325589Z","submitted_at":"2026-08-13T15:06:56Z","title":"Where You Measure Decides What You Measure: Position Selection in Ablation-Based SAE Evaluation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-14T13:29:00.188391Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2608.13337"},"observation_digest":"sha256:0f93f61bcf581b40b00d1fba2b33ba3c019e6e8ff1d9e8b4652314c6a1ff8c01","observation_id":"05b10829-4f1c-4001-9a7c-2183dbf21c1c","resolution":{"observed_at":"2026-08-14T13:29:00.188391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2403.00745/citation-record","integrity":"/paper/2403.00745/integrity","json":"/paper/2403.00745/citation-record.json","paper":"/paper/2403.00745"},"outbound":[],"paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-20T01:26:34.437000Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 35 inbound Pith citation observations for arXiv:2403.00745."}