{"as_of":"2026-08-08T06:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a6f257540cdf8644a64b5a86c423ca9ffb0367aafd6e20a84ef18008ad42f828","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T01:03:22.328312Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T03:50:15.977348Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T00:59:21.346717Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"cited_work":{"arxiv_id":"2506.12152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12152","snapshot_observed_at":"2026-07-04T00:59:21.346717Z","title":"VisualToolAgent (VisTA): A reinforcement learning framework for visual tool selection","venue":null,"work_id":"999186fc-4810-434b-96a8-ffa8a517d50d","year":2025},"citing_paper":{"arxiv_id":"2505.15436","last_updated":"2025-12-05T05:44:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-21T12:18:15Z","title":"Adaptive Chain-of-Focus Reasoning via Dynamic Visual Search and Zooming for Efficient VLMs","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-17T05:35:13.118221Z"},"links":{"cited_paper":"/paper/2506.12152","citing_paper":"/paper/2505.15436"},"observation_digest":"sha256:191735aeea6c3877e2ac6880c3f5ee64f3e8b0247d0871f1b3350370489f1959","observation_id":"8949abfc-dd1c-4b41-85b6-5aed53fdaacc","resolution":{"observed_at":"2026-05-17T05:35:13.274940Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12152","snapshot_observed_at":"2026-08-03T03:50:15.977348Z","title":"arXiv preprint arXiv:2506.12152 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06841","last_updated":"2026-05-31T17:09:07Z","snapshot_observed_at":"2026-08-07T09:03:38.579287Z","submitted_at":"2026-02-06T16:34:29Z","title":"From Features to Actions: Explainability in Traditional and Agentic AI Systems","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T03:50:15.977348Z"},"links":{"cited_paper":"/paper/2506.12152","citing_paper":"/paper/2602.06841"},"observation_digest":"sha256:aa5655adb63e8b920f9c7d3cc5bd146006ef907ba41de923de431f7396e87db6","observation_id":"715bf029-5944-4d4b-a090-5a2e8a47486a","resolution":{"observed_at":"2026-08-03T03:50:15.977348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"cited_work":{"arxiv_id":"2506.12152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12152","snapshot_observed_at":"2026-07-04T00:59:21.346717Z","title":"VisualToolAgent (VisTA): A reinforcement learning framework for visual tool selection","venue":null,"work_id":"999186fc-4810-434b-96a8-ffa8a517d50d","year":2025},"citing_paper":{"arxiv_id":"2606.07007","last_updated":"2026-06-05T07:52:43Z","snapshot_observed_at":"2026-08-04T06:36:27.490603Z","submitted_at":"2026-06-05T07:52:43Z","title":"A Geometric View for Understanding Concept Learning and Neuron Interpretation in Sparse Autoencoders","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-06-27T22:22:50.474397Z"},"links":{"cited_paper":"/paper/2506.12152","citing_paper":"/paper/2606.07007"},"observation_digest":"sha256:b471e1065173140e8449a5c7a3c9c37181787fcb1443750fbbfbf0baee14b92a","observation_id":"b9b42aa7-1170-456f-92e8-9d6809daa34b","resolution":{"observed_at":"2026-07-02T16:47:09.928488Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"cited_work":{"arxiv_id":"2506.12152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12152","snapshot_observed_at":"2026-07-04T00:59:21.346717Z","title":"VisualToolAgent (VisTA): A reinforcement learning framework for visual tool selection","venue":null,"work_id":"999186fc-4810-434b-96a8-ffa8a517d50d","year":2025},"citing_paper":{"arxiv_id":"2606.19559","last_updated":"2026-06-17T19:59:32Z","snapshot_observed_at":"2026-08-05T18:12:36.227027Z","submitted_at":"2026-06-17T19:59:32Z","title":"Uncertainty Decomposition for Clarification Seeking in LLM Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T20:44:06.027685Z"},"links":{"cited_paper":"/paper/2506.12152","citing_paper":"/paper/2606.19559"},"observation_digest":"sha256:4e7782275fca6af7e7ffc519a60094cf085cebd544d831781f102c02bb665b85","observation_id":"d0440bd1-9207-4522-b016-ff15cda7a584","resolution":{"observed_at":"2026-07-04T00:59:21.349255Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"cited_work":{"arxiv_id":"2506.12152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12152","snapshot_observed_at":"2026-07-04T00:59:21.346717Z","title":"VisualToolAgent (VisTA): A reinforcement learning framework for visual tool selection","venue":null,"work_id":"999186fc-4810-434b-96a8-ffa8a517d50d","year":2025},"citing_paper":{"arxiv_id":"2606.27510","last_updated":"2026-06-25T19:52:16Z","snapshot_observed_at":"2026-08-06T23:16:32.861154Z","submitted_at":"2026-06-25T19:52:16Z","title":"The Curse of Multiple Mediators: Hidden Interaction Effects in Activation Patching","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T01:47:46.342400Z"},"links":{"cited_paper":"/paper/2506.12152","citing_paper":"/paper/2606.27510"},"observation_digest":"sha256:5902d6ee4aacf5ffbf84bd81842a79969e3722b4b89ddcdd5dc968120dc807ea","observation_id":"6e828df5-a319-45ff-a816-957d22a9a462","resolution":{"observed_at":"2026-07-01T18:45:58.488988Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12152","snapshot_observed_at":"2026-07-31T23:35:49.490635Z","title":"& Tafjord, O","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23927","last_updated":"2026-07-27T01:47:12Z","snapshot_observed_at":"2026-08-06T16:06:32.827990Z","submitted_at":"2026-07-27T01:47:12Z","title":"Reality Monitoring in Large Language Models: Self-Knowledge That Transforms with Conversation Memory","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-07-31T23:35:49.490635Z"},"links":{"cited_paper":"/paper/2506.12152","citing_paper":"/paper/2607.23927"},"observation_digest":"sha256:80f8fdb96471314fcdea2ed9c1b72e5f9bce38536b85ff763f7509f33a9fb6ac","observation_id":"78706c2d-689e-48bf-a2ca-7c96dc239c67","resolution":{"observed_at":"2026-07-31T23:35:49.490635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.12152/citation-record","integrity":"/paper/2506.12152/integrity","json":"/paper/2506.12152/citation-record.json","paper":"/paper/2506.12152"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:23.543789Z","title":"Abdul, J","venue":null,"work_id":"86619b38-0682-4e92-87ce-a93536a188db","year":2018},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.157838Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:a71bb91ad2ce5130e334d92bc191fcac8944107f84b6b7b87aa038ec790375d3","observation_id":"91d74f30-bc4c-459d-9d54-e29fb3303496","resolution":{"observed_at":"2026-08-07T01:03:23.670680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03296","last_updated":"2023-08-07T04:47:42Z","snapshot_observed_at":"2026-07-06T16:03:14.694457Z","submitted_at":"2023-08-07T04:47:42Z","title":"Studying Large Language Model Generalization with Influence Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03296","snapshot_observed_at":"2026-08-07T01:03:20.807887Z","title":"Grosse, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.807887Z"},"links":{"cited_paper":"/paper/2308.03296","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:651ceed5228d1e7dbf884187d4dc6d4b91bd7e7b3df8957edf20df4cf4bdad6c","observation_id":"7309861d-5495-4868-847b-d9a5f7b77729","resolution":{"observed_at":"2026-08-07T01:03:20.807887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:20.917665Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.917665Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:99720011668e9e40b8200f83e19010b0fec77929aa4f939a8bbd512e66c72ff4","observation_id":"5660c1af-c3fc-4483-a960-a1a2a1234d4b","resolution":{"observed_at":"2026-08-07T01:03:20.917665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:21.093735Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.093735Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:d42ad500b729c8884a0a44a83db66c4133cae20463097c66992bb5cd53654a7a","observation_id":"065723a3-5382-48fc-8277-e83830fc674f","resolution":{"observed_at":"2026-08-07T01:03:21.093735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:21.338690Z","title":"doi: 10.1145/3564240","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.338690Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:1f5695840287c7db8fd7646af900ec0e27afdcf74cc7e5f133c11e4aa75c5385","observation_id":"99aaa16c-8ae6-4aa2-b35e-a55530ecda6a","resolution":{"observed_at":"2026-08-07T01:03:21.338690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01849","last_updated":"2025-04-02T15:59:31Z","snapshot_observed_at":"2026-08-07T16:14:13.125798Z","submitted_at":"2025-04-02T15:59:31Z","title":"An Approach to Technical AGI Safety and Security","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01849","snapshot_observed_at":"2026-08-07T01:03:21.407547Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.407547Z"},"links":{"cited_paper":"/paper/2504.01849","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:9b43310f112c8c78a32619725add89ad60b9ae162c86ac09b6e81f10a54b1dbc","observation_id":"b20b3980-7f26-480f-9757-23a47c91446e","resolution":{"observed_at":"2026-08-07T01:03:21.407547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16496","last_updated":"2025-01-27T20:57:18Z","snapshot_observed_at":"2026-07-06T20:27:04.664873Z","submitted_at":"2025-01-27T20:57:18Z","title":"Open Problems in Mechanistic Interpretability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16496","snapshot_observed_at":"2026-08-07T01:03:21.495743Z","title":"Sharkey, B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.495743Z"},"links":{"cited_paper":"/paper/2501.16496","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:6d6739d31437045c1ab3dd3e4f98132fcb890729913e6d7c8e20e105e0630735","observation_id":"5584384c-eafb-41cf-9f8c-642c945093dd","resolution":{"observed_at":"2026-08-07T01:03:21.495743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:21.637308Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.637308Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:b47bc60869715364fec4fd12365a113e8baf86751685e30cca3c81360860b4d7","observation_id":"f2e9c52c-864f-43da-97e9-fc5dcca42dd8","resolution":{"observed_at":"2026-08-07T01:03:21.637308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:21.710057Z","title":"doi: 10.18653/v1/D16-1159","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.710057Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:ca565ce954f53e57842e2070d031d7ebf514a214556c5f5e28d72270378fae67","observation_id":"a7bdb23f-159c-4c85-a2eb-c10b77497794","resolution":{"observed_at":"2026-08-07T01:03:21.710057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02674","last_updated":"2025-02-25T16:59:11Z","snapshot_observed_at":"2026-08-06T16:22:55.310872Z","submitted_at":"2024-12-03T18:47:26Z","title":"Mind the Gap: Examining the Self-Improvement Capabilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02674","snapshot_observed_at":"2026-08-07T01:03:21.917517Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.917517Z"},"links":{"cited_paper":"/paper/2412.02674","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:34622505ff9c703c6110d4d574f4321149aa33e88dd695f29f391e1c9074682d","observation_id":"eb7f58e0-4da1-417f-8b70-2b500455401a","resolution":{"observed_at":"2026-08-07T01:03:21.917517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05070","last_updated":"2024-08-20T19:14:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-07T18:21:17Z","title":"A Roadmap to Pluralistic Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05070","snapshot_observed_at":"2026-08-07T01:03:21.990940Z","title":"org/abs/2402.05070","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.990940Z"},"links":{"cited_paper":"/paper/2402.05070","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:025b7db7c5e7f9728b0150b25a54b2ae714c82e839b7f1722c586c5c64f02d9c","observation_id":"41a21ca5-2781-41f9-a691-92e990be6664","resolution":{"observed_at":"2026-08-07T01:03:21.990940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-07T01:03:22.291884Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:22.291884Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:330499ed72547f8484d57d04c0861011e3912ff381adaf65a4cd2d856ecf32c2","observation_id":"b9a5a264-c583-455f-8512-4cb5075a344e","resolution":{"observed_at":"2026-08-07T01:03:22.291884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01910","last_updated":"2023-03-10T17:20:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-03T15:43:03Z","title":"Large Language Models Are Human-Level Prompt Engineers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01910","snapshot_observed_at":"2026-08-07T01:03:22.328312Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:22.328312Z"},"links":{"cited_paper":"/paper/2211.01910","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:91a4859177d52201e963f65b86ffa836a93dd585cd6591ae720ac5f3ac051714","observation_id":"a9a5d7c8-0322-4597-9f3f-d296e7bb0d50","resolution":{"observed_at":"2026-08-07T01:03:22.328312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:22.067758Z","title":"URLhttps://www.ncbi","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":1974,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:22.067758Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:7366367207c040731b4d77b553f72c7755aa53dbc7877f5206d8bace66725958","observation_id":"c9c4d9f5-7700-4a11-892a-e4fe517619da","resolution":{"observed_at":"2026-08-07T01:03:22.067758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:23.165546Z","title":"Merriam-webster, Accessed on 2025-05-22","venue":null,"work_id":"58a8ef8b-d187-43df-bc9d-ec13993a9894","year":2025},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":1982,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.227715Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:3d1122544599c379a6b114c9cbb0ab6222bf9fbb074942b313dc27a3541bfb24","observation_id":"28924536-ca9b-4f84-a1e7-c13635f86df4","resolution":{"observed_at":"2026-08-07T01:03:23.233742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07882","last_updated":"2024-10-14T17:46:28Z","snapshot_observed_at":"2026-07-06T18:29:21.709395Z","submitted_at":"2024-06-12T05:20:16Z","title":"Designing a Dashboard for Transparency and Control of Conversational AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07882","snapshot_observed_at":"2026-08-07T01:03:20.611033Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":1993,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.611033Z"},"links":{"cited_paper":"/paper/2406.07882","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:c801afed25d0d394eb78c27a347e31faff67e408dd9de438e8814de7f1d65737","observation_id":"a2856cf9-3960-4f23-8784-086a987b8959","resolution":{"observed_at":"2026-08-07T01:03:20.611033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14093","last_updated":"2024-12-20T02:22:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T17:41:24Z","title":"Alignment faking in large language models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14093","snapshot_observed_at":"2026-08-07T01:03:20.741567Z","title":"URLhttps://www.science.org/doi/ abs/10.1126/science.1218633","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.741567Z"},"links":{"cited_paper":"/paper/2412.14093","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:7f7eb91345fac7f934a574b65210ab0d3ddd7585a1321c3b2ddef4b61988da94","observation_id":"ecd4a1a0-0a54-48aa-9cdd-44aae1d59611","resolution":{"observed_at":"2026-08-07T01:03:20.741567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T01:03:20.338834Z","title":"org/CorpusID:127197","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.338834Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:8195b8ff561ffa92d64fed8f936346449d4f8f586d8ef1150b43b5a26d2f9ed6","observation_id":"bdaa9f40-15d2-4727-9204-0c22b5514aad","resolution":{"observed_at":"2026-08-07T01:03:20.338834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:20.677305Z","title":"doi: 10.18653/v1/W16-2524","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.677305Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:316b5d4f795da56813896e47f73204968290e775dafdd709e3a753eae044904e","observation_id":"402b051c-2f8b-494d-9fe3-1b581854a724","resolution":{"observed_at":"2026-08-07T01:03:20.677305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10965","last_updated":"2025-03-28T01:48:40Z","snapshot_observed_at":"2026-08-07T20:46:51.964752Z","submitted_at":"2025-03-14T00:21:15Z","title":"Auditing language models for hidden objectives","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10965","snapshot_observed_at":"2026-08-07T01:03:21.160673Z","title":"Marks, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.160673Z"},"links":{"cited_paper":"/paper/2503.10965","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:6a47ff2e1e6066b80e79cf28cd8ce51d1c2a98068083d1a45401d54a9283cfd6","observation_id":"2f079495-60a1-40d6-a715-75f588fa91e0","resolution":{"observed_at":"2026-08-07T01:03:21.160673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.05382","last_updated":"2016-09-25T22:15:38Z","snapshot_observed_at":"2026-07-06T05:00:19.321986Z","submitted_at":"2016-06-16T23:18:23Z","title":"Sampling Method for Fast Training of Support Vector Data Description","version":3},"cited_work":{"arxiv_id":"1606.05382","doi":null,"metadata_source":"pith","pith_arxiv_id":"1606.05382","snapshot_observed_at":"2026-08-07T01:03:23.013530Z","title":"Sampling Method for Fast Training of Support Vector Data Description","venue":"cs.LG","work_id":"4f32f8a3-5dc1-4c98-86b9-1fb6410b522d","year":2016},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.264372Z"},"links":{"cited_paper":"/paper/1606.05382","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:439ac7dfff2b8974a3a8c9ae3e1725983cc11154b2aaf8fdd10954368ee5904b","observation_id":"c08c3d79-8d55-437c-8cf4-6c9365c936ab","resolution":{"observed_at":"2026-08-07T01:03:23.104484Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:23.297562Z","title":null,"venue":null,"work_id":"2c3ac1ce-21c1-41c9-af6f-34dcd2d42737","year":1902},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.522955Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:39cc8c83a88bfaacbd81113709edc33f0db75385540fc9f756fa27c7732fa228","observation_id":"56ab1b47-fcb6-4cfd-99c8-6d4a8185974d","resolution":{"observed_at":"2026-08-07T01:03:23.350522Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.15980","last_updated":"2020-11-07T05:33:35Z","snapshot_observed_at":"2026-08-05T14:17:34.026911Z","submitted_at":"2020-10-29T22:54:00Z","title":"AutoPrompt: Eliciting Knowledge from Language Models with Automatically Generated Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.15980","snapshot_observed_at":"2026-08-07T01:03:21.800720Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.800720Z"},"links":{"cited_paper":"/paper/2010.15980","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:82d2e4359a00c785cb954eadf7ccf6f11e7361aeebe079fd2932d0ce4e309ffb","observation_id":"8f150441-741f-4da9-b5ca-13a1248d9ad8","resolution":{"observed_at":"2026-08-07T01:03:21.800720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.tics.2021.07.008","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:22.469548Z","title":null,"venue":null,"work_id":"d57dc866-23f6-45e3-8f38-8bec7701299f","year":2021},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.871098Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:c0649f7eb4469aedd0915867a03948f58615cb7e549c8914722e52f558381161","observation_id":"b6adca01-aeda-4876-9a8b-2b6856c8ceec","resolution":{"observed_at":"2026-08-07T01:03:22.527682Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:23.428578Z","title":null,"venue":null,"work_id":"82b06099-ecd0-421a-90a8-7d40a8f66688","year":2021},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.405726Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:1613241fe5f7ddfdf4bdc005f6d421f8e0d87d75b2149044cbc4be88cd35f6be","observation_id":"c147767b-17da-4232-8d06-db94f7cb54d5","resolution":{"observed_at":"2026-08-07T01:03:23.491721Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.05217","last_updated":"2023-10-19T21:25:32Z","snapshot_observed_at":"2026-08-02T10:20:00.635719Z","submitted_at":"2023-01-12T18:56:49Z","title":"Progress measures for grokking via mechanistic interpretability","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.05217","snapshot_observed_at":"2026-08-07T01:03:21.272090Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.272090Z"},"links":{"cited_paper":"/paper/2301.05217","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:dbc6b905064ec6cf240fee66065ebd97ed0e51d835745d3734f6839bccb78983","observation_id":"009c88f1-a1f1-46ef-8ef4-504a046f3b1c","resolution":{"observed_at":"2026-08-07T01:03:21.272090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10380","last_updated":"2024-11-28T01:21:26Z","snapshot_observed_at":"2026-08-07T14:55:14.006555Z","submitted_at":"2024-11-28T01:21:26Z","title":"Challenges in Human-Agent Communication","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10380","snapshot_observed_at":"2026-08-07T01:03:20.470352Z","title":null,"venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.470352Z"},"links":{"cited_paper":"/paper/2412.10380","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:5a8b93fe3f5d6e6b0bdb0e5b1d47d9b4ddb0a2bb089e820d73e622e4254e820b","observation_id":"a287e320-3fd1-421a-b9ef-8b7bf845bac5","resolution":{"observed_at":"2026-08-07T01:03:20.470352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07586","last_updated":"2025-02-11T14:34:05Z","snapshot_observed_at":"2026-08-05T23:45:07.985810Z","submitted_at":"2025-02-11T14:34:05Z","title":"We Can't Understand AI Using our Existing Vocabulary","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07586","snapshot_observed_at":"2026-08-07T01:03:21.013201Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.013201Z"},"links":{"cited_paper":"/paper/2502.07586","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:01e4abde2a83e2136e78a77ee589aba9792746b22594a8136b7e2c17af034cbe","observation_id":"2bd2d3f5-d96d-47ae-85b0-ee97be0b6d7f","resolution":{"observed_at":"2026-08-07T01:03:21.013201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T20:47:30.133692Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":24,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 6 inbound Pith citation observations for arXiv:2506.12152."}