{"as_of":"2026-08-10T21:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:06b47b048f1bbfceb95c0f5b761cdd57b264e5214b3416537fbaec22512759d6","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":36,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T04:36:43.804112Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":32,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-07-06T16:19:05.495349Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-24T06:42:23.274826Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2309.08600"},"observation_digest":"sha256:e9b055f46a4a68addf8ae863feebd80028a21089b64b812d20301a4d5b3538c4","observation_id":"b618ee32-d664-46f8-9765-d3fc53dce4d8","resolution":{"observed_at":"2026-05-24T06:44:02.183406Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2404.15255","last_updated":"2024-04-23T17:42:29Z","snapshot_observed_at":"2026-07-31T21:25:53.647335Z","submitted_at":"2024-04-23T17:42:29Z","title":"How to use and interpret activation patching","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T20:34:06.888683Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2404.15255"},"observation_digest":"sha256:d698d7e0aed3a79636b72adaf205ebb60e3a3bf438fd5455ca0a874fe07fe795","observation_id":"58bcce53-5c39-481b-9cde-cd4d88398c66","resolution":{"observed_at":"2026-05-16T20:34:06.914206Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2408.05147","last_updated":"2024-08-19T07:51:05Z","snapshot_observed_at":"2026-08-04T11:44:14.524984Z","submitted_at":"2024-08-09T16:06:42Z","title":"Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T05:47:19.953111Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2408.05147"},"observation_digest":"sha256:75c953ede0e1193e5bd8d18ee00ffd3c2191bae5171fd2c6407ee0a0140f9bde","observation_id":"82f206c9-eff3-4bc6-a355-f557798bbec4","resolution":{"observed_at":"2026-05-15T05:47:20.036422Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-10T04:36:43.804112Z","title":"Mavor-Parker, Aengus Lynch, Stefan Heimersheim, and Adrià Garriga-Alonso","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.17755","last_updated":"2025-03-05T16:20:03Z","snapshot_observed_at":"2026-08-10T13:37:01.714276Z","submitted_at":"2025-01-29T16:48:13Z","title":"AI Governance through Markets","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T04:36:43.804112Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2501.17755"},"observation_digest":"sha256:a71f635b16e779a686d2f4bdfb5817a4be67c1bf68eed67845e3fdc68f8eca0c","observation_id":"dbb44eab-a1fb-4e01-b41e-698aeab39382","resolution":{"observed_at":"2026-08-10T04:36:43.804112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-09T22:24:53.827765Z","title":"N., Lynch, A., Heimersheim, S., and Garriga-Alonso, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-09T22:18:47.455459Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.827765Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:9e1f34059e11ade9221b5ae02cc56da906bbb5a123dda1ea38b98ca81fd9152c","observation_id":"69061fed-e49d-4c2b-8b98-dd09645abde2","resolution":{"observed_at":"2026-08-09T22:24:53.827765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-09T17:58:34.145737Z","title":"Mavor-Parker, Aengus Lynch, Stefan Heimer- sheim, and Adrià Garriga-Alonso","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00726","last_updated":"2025-02-02T09:15:27Z","snapshot_observed_at":"2026-08-09T22:10:55.662622Z","submitted_at":"2025-02-02T09:15:27Z","title":"Perspectives for Direct Interpretability in Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T17:58:34.145737Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2502.00726"},"observation_digest":"sha256:7537837f5c3482ac1f135007b1df2e32d6fc24d510ceaff0d07a4fbad258985d","observation_id":"c689dd0f-0093-4237-bcae-33c9267541da","resolution":{"observed_at":"2026-08-09T17:58:34.145737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-07T15:00:54.375524Z","title":"N., Lynch, A., Heimersheim, S., and Garriga-Alonso, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16694","last_updated":"2025-06-10T05:24:12Z","snapshot_observed_at":"2026-08-09T18:40:45.336378Z","submitted_at":"2025-05-22T13:59:30Z","title":"Beyond Induction Heads: In-Context Meta Learning Induces Multi-Phase Circuit Emergence","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:00:54.375524Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2505.16694"},"observation_digest":"sha256:39a007f9bceda2c0c03ec1d965db5b42ade4baec15414c379524c9c058b9d8d4","observation_id":"ca0e0547-91ee-4238-a000-c40b0245b7fd","resolution":{"observed_at":"2026-08-07T15:00:54.375524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-07T12:35:36.560849Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24731","last_updated":"2025-05-30T15:53:56Z","snapshot_observed_at":"2026-08-10T03:42:05.075554Z","submitted_at":"2025-05-30T15:53:56Z","title":"Circuit Stability Characterizes Language Model Generalization","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:36.560849Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2505.24731"},"observation_digest":"sha256:90e992f75eea943e515eff0711308be11df579ce209927cb1397f91710a3bbe8","observation_id":"7a045aa9-53ee-46d0-948d-5305715a72bb","resolution":{"observed_at":"2026-08-07T12:35:36.560849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T17:37:55.872665Z","title":"Mavor-Parker, Aengus Lynch, Stefan Heimersheim, and Adrià Garriga-Alonso","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.16109","last_updated":"2025-08-22T05:54:11Z","snapshot_observed_at":"2026-08-10T03:57:56.248075Z","submitted_at":"2025-08-22T05:54:11Z","title":"From Indirect Object Identification to Syllogisms: Exploring Binary Mechanisms in Transformer Circuits","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T17:37:55.872665Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2508.16109"},"observation_digest":"sha256:1e096ac9f230e07055a5fd28987d1d373a5948c4a31fe35e97e4e92e184d83ff","observation_id":"e2bfb6fd-c972-4e1d-9227-d18828cdc1fd","resolution":{"observed_at":"2026-08-05T17:37:55.872665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-04T16:40:31.149122Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.12672","last_updated":"2026-05-23T09:33:32Z","snapshot_observed_at":"2026-08-10T12:24:50.454370Z","submitted_at":"2025-09-16T04:51:18Z","title":"Towards Inclusive Toxic Content Moderation: Addressing Vulnerabilities to Adversarial Attacks in Toxicity Classifiers Tackling LLM-generated Content","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T16:40:31.149122Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2509.12672"},"observation_digest":"sha256:5e54becb4671fde9f25eb26cdd9fca091b3b594f48ca68c05f953d15d1ca0eca","observation_id":"7e2e582d-84cf-4b6f-af44-3536a0ba7fa2","resolution":{"observed_at":"2026-08-04T16:40:31.149122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-03T06:35:33.648793Z","title":"Cotra, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.22594","last_updated":"2026-06-11T01:15:40Z","snapshot_observed_at":"2026-08-10T04:06:14.110595Z","submitted_at":"2026-01-30T05:41:19Z","title":"Language Model Circuits Are Sparse in the Neuron Basis","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T06:35:33.648793Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2601.22594"},"observation_digest":"sha256:3b6db7b7a37a9fb7f47a648d85f2b03452b73d3479d7fa6746d048c1f826d8c2","observation_id":"b5b7cd1b-4e74-4a8a-89b1-e04ac683ef05","resolution":{"observed_at":"2026-08-03T06:35:33.648793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-03T03:50:15.149847Z","title":"Advances in Neural Information Processing Systems arXiv:2304.14997 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.06841","last_updated":"2026-05-31T17:09:07Z","snapshot_observed_at":"2026-08-09T07:23:34.031341Z","submitted_at":"2026-02-06T16:34:29Z","title":"From Features to Actions: Explainability in Traditional and Agentic AI Systems","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T03:50:15.149847Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2602.06841"},"observation_digest":"sha256:7c81a5bfadb6d913aff9c64c9c924a65aef31a105e6a01c2da7c013433ea0394","observation_id":"935921d7-9ffd-4335-8944-20ba480364d2","resolution":{"observed_at":"2026-08-03T03:50:15.149847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-07-13T13:35:02.428552Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.03042","last_updated":"2026-06-04T11:31:33Z","snapshot_observed_at":"2026-08-05T20:36:40.496423Z","submitted_at":"2026-04-03T13:51:23Z","title":"Enhancing Multi-Robot Exploration Using Probabilistic Frontier Prioritization with Dirichlet Process Gaussian Mixtures","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T13:35:02.428552Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2604.03042"},"observation_digest":"sha256:39c7e9c2174b89997e97df4451bfeceaa9de80acb2071e0cccdbfaae76377cee","observation_id":"2dc8261f-3111-4f91-8dbd-e8464cac9ab0","resolution":{"observed_at":"2026-07-13T13:35:02.428552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2604.03045","last_updated":"2026-04-03T13:52:57Z","snapshot_observed_at":"2026-07-06T22:52:20.577677Z","submitted_at":"2026-04-03T13:52:57Z","title":"STEAR: Layer-Aware Spatiotemporal Evidence Intervention for Hallucination Mitigation in Video Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T20:16:04.999705Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2604.03045"},"observation_digest":"sha256:6d33431a036d152aa2c1440543bd1619587a3ef0a6a44e15352325ad84f9f9d6","observation_id":"e34a12d1-2961-4a5c-9701-c9a274f3d1eb","resolution":{"observed_at":"2026-05-13T20:18:13.386322Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2604.19826","last_updated":"2026-04-20T14:47:46Z","snapshot_observed_at":"2026-07-06T23:06:26.596990Z","submitted_at":"2026-04-20T14:47:46Z","title":"Co-Located Tests, Better AI Code: How Test Syntax Structure Affects Foundation Model Code Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T04:21:39.637962Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2604.19826"},"observation_digest":"sha256:4b36ea2a89ffb66249a01fbf9120af785266888ea27ad7986714c749aedf5d57","observation_id":"614ee7ab-659c-4a58-9fb8-20b114024c09","resolution":{"observed_at":"2026-05-11T12:01:05.319756Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2604.22128","last_updated":"2026-06-16T03:20:04Z","snapshot_observed_at":"2026-07-06T23:08:33.204647Z","submitted_at":"2026-04-24T00:26:34Z","title":"Dissociating Decodability and Causal Use in Bracket-Sequence Transformers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T12:12:32.768674Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2604.22128"},"observation_digest":"sha256:6e7f8c50534b16ae2c1d0edf9b223493c440822339781826ec0f1888ca3c9026","observation_id":"eed9b08f-35e9-45fa-8c7c-311d6d5efd39","resolution":{"observed_at":"2026-05-08T21:39:24.472752Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2605.06335","last_updated":"2026-05-07T14:26:32Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:26:32Z","title":"Eliciting associations between clinical variables from LLMs via comparison questions across populations","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-08T12:59:49.837750Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2605.06335"},"observation_digest":"sha256:9a0fdc2e07eb8431988da88ed2a228d16edbf8e831fc08fdd226835de8eca7fb","observation_id":"a28a9de0-9ca5-4305-b7e9-5447e21d31af","resolution":{"observed_at":"2026-05-08T21:34:13.339991Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2605.09881","last_updated":"2026-05-11T02:11:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T02:11:47Z","title":"Dissecting Jet-Tagger Through Mechanistic Interpretability","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-12T04:49:09.296991Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2605.09881"},"observation_digest":"sha256:79dfe9421fc9d368182fb3927a9b2a85a168d2b0ef1baf85d4962742f01a3e6d","observation_id":"9c2d2b64-9fae-4120-ac89-28b8c913dea6","resolution":{"observed_at":"2026-05-12T04:51:22.769645Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2605.12809","last_updated":"2026-05-12T23:01:29Z","snapshot_observed_at":"2026-07-06T23:24:27.821980Z","submitted_at":"2026-05-12T23:01:29Z","title":"Correcting Influence: Unboxing LLM Outputs with Orthogonal Latent Spaces","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-05-14T20:17:01.224864Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2605.12809"},"observation_digest":"sha256:e6a49ff3598ad03be1a94b6ea5004dc56e48abaa2e5b3f35be99311ba7a752d2","observation_id":"647671f6-376d-4840-ad97-dd99c985d888","resolution":{"observed_at":"2026-05-14T20:17:53.992568Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2605.12991","last_updated":"2026-05-16T19:42:13Z","snapshot_observed_at":"2026-07-06T23:24:37.915639Z","submitted_at":"2026-05-13T04:45:08Z","title":"Not Just RLHF: Why Alignment Alone Won't Fix Multi-Agent Sycophancy","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-14T20:04:57.638215Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2605.12991"},"observation_digest":"sha256:5e67d5aad92cf9f3ac4974d4eafcfb96a0d94f76132be1dd64fef2e113e8f4e5","observation_id":"b9f33560-3e0f-4132-a279-c09b14bc4ff0","resolution":{"observed_at":"2026-05-14T20:07:53.882972Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2605.12991","last_updated":"2026-05-16T19:42:13Z","snapshot_observed_at":"2026-07-06T23:24:37.915639Z","submitted_at":"2026-05-13T04:45:08Z","title":"Not Just RLHF: Why Alignment Alone Won't Fix Multi-Agent Sycophancy","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T21:30:30.384184Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2605.12991"},"observation_digest":"sha256:6fa817b0f763401a0ed4d66d43044b7cc889df13e4aec5643e67fdc97585d328","observation_id":"3621a9d6-d6ff-4329-8ec4-5fb2336b0556","resolution":{"observed_at":"2026-05-20T21:33:46.486479Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2605.13625","last_updated":"2026-05-13T14:52:40Z","snapshot_observed_at":"2026-08-10T21:06:03.819596Z","submitted_at":"2026-05-13T14:52:40Z","title":"How to Interpret Agent Behavior","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-14T18:23:25.269217Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2605.13625"},"observation_digest":"sha256:7e713e518afa903f73fce1bcd9d08434736f477ab9156d0b741d5d71658236fd","observation_id":"bf50b9f1-1011-4798-89dc-6094a9ed5059","resolution":{"observed_at":"2026-05-14T18:27:35.897382Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2605.15183","last_updated":"2026-05-14T17:58:27Z","snapshot_observed_at":"2026-07-06T23:26:32.979566Z","submitted_at":"2026-05-14T17:58:27Z","title":"When Are Two Networks the Same? Tensor Similarity for Mechanistic Interpretability","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T03:17:22.217041Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2605.15183"},"observation_digest":"sha256:e00d61db83072a78f83e12b6b932a1332fc332d02df4c4e34c5d90e1e8afc4f8","observation_id":"2e7032fa-05a0-4eb4-99da-673ba84149d2","resolution":{"observed_at":"2026-05-15T03:19:43.704142Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2605.22462","last_updated":"2026-05-21T13:25:16Z","snapshot_observed_at":"2026-07-06T23:32:49.530788Z","submitted_at":"2026-05-21T13:25:16Z","title":"From Correlation to Cause: A Five-Stage Methodology for Feature Analysis in Transformer Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T06:56:18.332754Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2605.22462"},"observation_digest":"sha256:d60bd76258b138f7a83cf67a07ba038e7c3e8698cf290f376b477a98e8d32620","observation_id":"3928ba05-de27-4b63-89f3-4511d7010a7c","resolution":{"observed_at":"2026-05-22T07:01:11.983212Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-07-13T09:07:13.817929Z","title":"Andy Zou, Zifan Wang, Nicholas Carlini, Milad Nasr, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.28825","last_updated":"2026-04-07T18:05:06Z","snapshot_observed_at":"2026-08-03T04:58:22.791780Z","submitted_at":"2026-04-07T18:05:06Z","title":"MechELK: A Mechanistic Interpretability Framework for Eliciting Latent Knowledge in Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T09:07:13.817929Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2605.28825"},"observation_digest":"sha256:15893cf8613c80c98af16506b36d422eb07f2766d98abd719c41a4d6138cd81b","observation_id":"a51b679d-5aa3-48e3-a009-2b59bdf01ae2","resolution":{"observed_at":"2026-07-13T09:07:13.817929Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2606.19317","last_updated":"2026-06-29T15:31:17Z","snapshot_observed_at":"2026-08-03T17:04:51.637554Z","submitted_at":"2026-06-17T17:40:55Z","title":"Explaining Attention with Program Synthesis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T20:46:01.403927Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2606.19317"},"observation_digest":"sha256:30ad32899f67fd6dc61a862d0decfe5d6f9c3bae5306c16894a1b0ef17923e18","observation_id":"5ef6806d-c57c-4110-a422-31cb39da382a","resolution":{"observed_at":"2026-07-04T00:59:21.019640Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2606.19317","last_updated":"2026-06-29T15:31:17Z","snapshot_observed_at":"2026-08-03T17:04:51.637554Z","submitted_at":"2026-06-17T17:40:55Z","title":"Explaining Attention with Program Synthesis","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T10:20:46.759958Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2606.19317"},"observation_digest":"sha256:f4b42331f060dbeeddf658aa7c77b0585a7898343b82f1b09f9d96a8c9fc97b6","observation_id":"8176dc3b-dbf9-46e6-bfec-a7bdc664a3ce","resolution":{"observed_at":"2026-06-30T11:54:39.156734Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2607.00924","last_updated":"2026-07-01T13:26:10Z","snapshot_observed_at":"2026-08-07T23:46:28.286621Z","submitted_at":"2026-07-01T13:26:10Z","title":"Graph-Native Reinforcement Learning Enables Traceable Scientific Hypothesis Generation through Conceptual Recombination","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-07-02T12:26:46.384850Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2607.00924"},"observation_digest":"sha256:218fc92f6011fbd170bdb32c963b1a47801708620e47d10335d02a6d870282cb","observation_id":"b0da2d27-f41d-4260-9491-cc950260ffc4","resolution":{"observed_at":"2026-07-02T12:26:55.883819Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2607.07316","last_updated":"2026-07-08T12:04:38Z","snapshot_observed_at":"2026-08-07T03:56:05.019257Z","submitted_at":"2026-07-08T12:04:38Z","title":"Mechanistic Interpretability for Neural Networks: Circuits, Sparse Features and Symbolic Reasoning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-09T14:58:58.363330Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2607.07316"},"observation_digest":"sha256:9f4ee8867fb46a9db2238371b6b00d879bb8ef011ec811951d3e6e0183931540","observation_id":"44d33f06-a2b5-4278-847a-5d8abde742ba","resolution":{"observed_at":"2026-07-09T15:06:18.046309Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-02T10:39:48.831071Z","title":"and Lynch, Aengus and Heimersheim, Stefan and Garriga-Alonso, Adrià , month = oct, year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13047","last_updated":"2026-06-19T19:07:38Z","snapshot_observed_at":"2026-08-10T04:42:58.694391Z","submitted_at":"2026-06-19T19:07:38Z","title":"Targeted Recovery of Weight-Space Mechanisms From Neural Networks","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T10:39:48.831071Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2607.13047"},"observation_digest":"sha256:21a690130407def9092e2f837dbb2e662292b908b2e65e964bc29cef999fb109","observation_id":"625e0109-428b-4739-9faf-aba305a4a487","resolution":{"observed_at":"2026-08-02T10:39:48.831071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-02T10:40:01.245170Z","title":"N., Lynch, A., Heimersheim, S., and Garriga-Alonso, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13047","last_updated":"2026-06-19T19:07:38Z","snapshot_observed_at":"2026-08-10T04:42:58.694391Z","submitted_at":"2026-06-19T19:07:38Z","title":"Targeted Recovery of Weight-Space Mechanisms From Neural Networks","version":1},"reference_index":154,"source":"arxiv_source","source_observed_at":"2026-08-02T10:40:01.245170Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2607.13047"},"observation_digest":"sha256:f0f010edfdde8f866a8713e17432193983235cd4be8023a2b64dd7adb8d041bd","observation_id":"a9d1c8ec-a8e5-478a-a2af-36ec007339b5","resolution":{"observed_at":"2026-08-02T10:40:01.245170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-01T18:58:29.659933Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17138","last_updated":"2026-07-19T08:50:12Z","snapshot_observed_at":"2026-08-10T13:30:04.025356Z","submitted_at":"2026-07-19T08:50:12Z","title":"Denoising Models Develop Human-Like Perceptual Illusion Representations Across Architectures","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T18:58:29.659933Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2607.17138"},"observation_digest":"sha256:ac81db8cd54dd5aaf38f5d8c45128d171f6f42cc272f3cfc66f480133a606cd7","observation_id":"7bfc993f-2e67-4949-8221-d77f98e3a6f7","resolution":{"observed_at":"2026-08-01T18:58:29.659933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-02T14:26:49.070810Z","title":"Mavor-Parker, Aengus Lynch, Stefan Heimersheim, and Adri`a Garriga-Alonso","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20436","last_updated":"2026-05-11T13:44:35Z","snapshot_observed_at":"2026-08-07T15:21:11.046444Z","submitted_at":"2026-05-11T13:44:35Z","title":"Routing Subspaces: Auditing Evaluation-to-Deployment Mismatch in Fine-Tuned Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T14:26:49.070810Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2607.20436"},"observation_digest":"sha256:b222c024815c2fb15b338cc2f6420ce3cdcb4416864b243f76454f769efcfab7","observation_id":"09a6bc1d-8b09-4c55-ae82-bcf4390311af","resolution":{"observed_at":"2026-08-02T14:26:49.070810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-01T05:25:22.684556Z","title":"arXiv preprint arXiv:2304.14997 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22251","last_updated":"2026-08-07T15:51:17Z","snapshot_observed_at":"2026-08-10T21:13:13.982736Z","submitted_at":"2026-07-24T12:34:46Z","title":"IFCLoRA: Topology-Aware Rank Allocation for Parameter-Efficient Fine-Tuning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T05:25:22.684556Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2607.22251"},"observation_digest":"sha256:c96027ae582b38fb83ae78f4a2e4edee4191ace7080a6c1657523a071c6fa221","observation_id":"c7406690-c367-4403-b650-4b17f2da9be3","resolution":{"observed_at":"2026-08-01T05:25:22.684556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-07-31T23:35:49.065747Z","title":"N., Lynch, A., Heimersheim, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23927","last_updated":"2026-07-27T01:47:12Z","snapshot_observed_at":"2026-08-09T08:36:12.705210Z","submitted_at":"2026-07-27T01:47:12Z","title":"Reality Monitoring in Large Language Models: Self-Knowledge That Transforms with Conversation Memory","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-31T23:35:49.065747Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2607.23927"},"observation_digest":"sha256:daef3dfa86907f1361ea5b6eb8010502e055455ced8ad08921c72d41f72791c0","observation_id":"72e03d84-8e20-482a-970c-1563cb3fd42b","resolution":{"observed_at":"2026-07-31T23:35:49.065747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-03T00:47:35.968722Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28672","last_updated":"2026-07-26T01:32:45Z","snapshot_observed_at":"2026-08-06T22:33:50.446500Z","submitted_at":"2026-07-26T01:32:45Z","title":"LAWFUL: Law-Aligned Witness for Faithful Use of Latents","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-03T00:47:35.968722Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2607.28672"},"observation_digest":"sha256:7b3faea2a18e7f759810a8ab4bb568011a90326f8d04ef47cd5c940a571584a3","observation_id":"e8f5fb39-df29-424a-a215-ab20e6bdcd34","resolution":{"observed_at":"2026-08-03T00:47:35.968722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2304.14997/citation-record","integrity":"/paper/2304.14997/integrity","json":"/paper/2304.14997/citation-record.json","paper":"/paper/2304.14997"},"outbound":[],"paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 36 inbound Pith citation observations for arXiv:2304.14997."}