{"as_of":"2026-08-22T23:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0a6deb2fcb79997bbe121864c6555731742eac1d497dc0a075aade744ab15578","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":40,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:06:05.025646Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":6,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-11T20:37:54.690268Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.05563","last_updated":"2025-07-01T22:08:39Z","snapshot_observed_at":"2026-08-16T14:41:18.143042Z","submitted_at":"2024-12-07T06:56:01Z","title":"A Survey on Uncertainty Quantification of Large Language Models: Taxonomy, Open Research Challenges, and Future Directions","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:54.690268Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2412.05563"},"observation_digest":"sha256:b4ae780a89317d4cdfc3e74d45ade43ecaff97706ed7b8146299179a3e7c0729","observation_id":"379428b2-cf50-43eb-abad-fc51edc418c7","resolution":{"observed_at":"2026-08-11T20:37:54.690268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-12T21:17:17.200001Z","title":"Transcoders Find Interpretable LLM Feature Circuits, November 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12101","last_updated":"2024-11-13T18:51:21Z","snapshot_observed_at":"2026-08-14T07:35:41.775522Z","submitted_at":"2024-11-13T18:51:21Z","title":"InterPLM: Discovering Interpretable Features in Protein Language Models via Sparse Autoencoders","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T21:17:17.200001Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2412.12101"},"observation_digest":"sha256:3c72f028378d87b960997d50cd7ed09800a9426a7d8cbd5591093826b8d5d29b","observation_id":"0c22a108-5382-4e22-88ba-fb89956978d7","resolution":{"observed_at":"2026-08-12T21:17:17.200001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-10T14:55:02.002736Z","title":"Transcoders find interpretable llm feature circuits, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-18T04:36:12.878322Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.002736Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:2699e57ba27f936f499ca8ba58a97fd9ec3db9b0256ce94285dcee72bae672a8","observation_id":"857d6d2a-c940-435b-af91-f7e7e6bbd5e5","resolution":{"observed_at":"2026-08-10T14:55:02.002736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-09T22:24:53.833482Z","title":"Transcoders find interpretable llm feature circuits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.833482Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:6b2a625b9a81bead4eb9bb814be095d3e37a83565b7f29ee4bf0d3041d5ac986","observation_id":"0e814619-2107-4595-9062-a38af8b9a3cd","resolution":{"observed_at":"2026-08-09T22:24:53.833482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-09T22:21:50.720744Z","title":"Transcoders find interpretable llm feature circuits","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.18838","last_updated":"2025-01-31T01:12:50Z","snapshot_observed_at":"2026-08-20T17:09:35.504109Z","submitted_at":"2025-01-31T01:12:50Z","title":"Partially Rewriting a Transformer in Natural Language","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T22:21:50.720744Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2501.18838"},"observation_digest":"sha256:dde04493411af46975e2dbafe95e39ee9673be25654e91c06cb96ad39c06c034","observation_id":"bd32d894-72f3-43de-a43d-bd0ce0c9275c","resolution":{"observed_at":"2026-08-09T22:21:50.720744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-09T17:58:34.177121Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00726","last_updated":"2025-02-02T09:15:27Z","snapshot_observed_at":"2026-08-13T16:36:49.694606Z","submitted_at":"2025-02-02T09:15:27Z","title":"Perspectives for Direct Interpretability in Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T17:58:34.177121Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2502.00726"},"observation_digest":"sha256:649b8e72cad9c2fc4edde7cd5dd3623dad57b02334fa09a474aae9bbcd966b1f","observation_id":"bd06ef27-8348-4db3-9da3-6a3aeef9afdb","resolution":{"observed_at":"2026-08-09T17:58:34.177121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-09T10:11:51.469627Z","title":"Transcoders find interpretable llm feature circuits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03032","last_updated":"2025-07-24T21:16:27Z","snapshot_observed_at":"2026-08-15T22:22:36.614106Z","submitted_at":"2025-02-05T09:39:34Z","title":"Analyze Feature Flow to Enhance Interpretation and Steering in Language Models","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T10:11:51.469627Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2502.03032"},"observation_digest":"sha256:58b5cf45cfaf6f554890c5718fcc5eae5ae7fa9c0bdafd78b52257fe109d0781","observation_id":"b7aadacf-6725-4519-b232-02aba34b30f3","resolution":{"observed_at":"2026-08-09T10:11:51.469627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-08T21:12:13.815125Z","title":"Transcoders find interpretable llm feature circuits","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-08-20T10:57:19.308652Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:13.815125Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2502.04878"},"observation_digest":"sha256:18cfe7cd1ebc2eb27aa8d47cbfc554dbd8696e68da1367d00e6c9eff52ad326b","observation_id":"874c877f-280d-497d-bf95-e3984e979e07","resolution":{"observed_at":"2026-08-08T21:12:13.815125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-16T12:06:05.025646Z","title":"Transcoders find interpretable llm feature circuits, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13756","last_updated":"2025-04-18T15:45:30Z","snapshot_observed_at":"2026-08-17T18:19:11.612066Z","submitted_at":"2025-04-18T15:45:30Z","title":"Scaling sparse feature circuit finding for in-context learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:05.025646Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2504.13756"},"observation_digest":"sha256:c49deff33ee6cfcf0340912ddf3926fcb2b82232edad3b5cb6c5999f1d01412c","observation_id":"41b87ddb-d447-4b82-87c5-ef8e8d67fea8","resolution":{"observed_at":"2026-08-16T12:06:05.025646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-16T05:21:33.927686Z","title":"Transcoders find interpretable LLM feature circuits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-18T16:00:55.179412Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.927686Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:12d10b42cf3e7550e1cc8307ac691fb44aa150f15075d4cd9b45f38eefddcf2c","observation_id":"a5bf3096-13ae-4fc6-b63d-faf210e7058f","resolution":{"observed_at":"2026-08-16T05:21:33.927686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-07T11:56:15.162228Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01197","last_updated":"2025-06-01T22:20:07Z","snapshot_observed_at":"2026-08-21T20:36:56.614840Z","submitted_at":"2025-06-01T22:20:07Z","title":"Incorporating Hierarchical Semantics in Sparse Autoencoder Architectures","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:15.162228Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2506.01197"},"observation_digest":"sha256:c50c1a3aca788d7217b06c8527321d16ed67966ac35ca30ce93368386fe3acf1","observation_id":"1bdd8fd1-31fb-440f-ac7e-f730a830fca3","resolution":{"observed_at":"2026-08-07T11:56:15.162228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-06T23:28:21.072683Z","title":"Transcoders find interpretable llm feature circuits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18183","last_updated":"2025-07-18T02:39:29Z","snapshot_observed_at":"2026-08-21T21:54:27.000460Z","submitted_at":"2025-06-22T21:46:42Z","title":"Reasoning about Uncertainty: Do Reasoning Models Know When They Don't Know?","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:21.072683Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2506.18183"},"observation_digest":"sha256:c62a281332d39fcea9ed3cc17cf873e9fc36e8aee923ed6df069904055da6ea6","observation_id":"73fed3ac-c32c-4424-987d-535437ef2b76","resolution":{"observed_at":"2026-08-06T23:28:21.072683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-15T18:40:37.650165Z","title":"Transcoders find interpretable llm feature circuits.arXiv preprint arXiv:2406.11944, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19549","last_updated":"2025-06-24T11:55:43Z","snapshot_observed_at":"2026-08-17T16:59:17.899486Z","submitted_at":"2025-06-24T11:55:43Z","title":"RCStat: A Statistical Framework for using Relative Contextualization in Transformers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T18:40:37.650165Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2506.19549"},"observation_digest":"sha256:e2ca91feadd3a0a37a2c118f4bfdb4af0c34d9a8640e0639077c5b25b6bd21a7","observation_id":"305bf029-f788-413c-a67e-86e59700806e","resolution":{"observed_at":"2026-08-15T18:40:37.650165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-06T23:03:04.924942Z","title":"doi: 10.18653/v1/ 2021.emnlp-main.98","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-14T19:03:44.824832Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.924942Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:1e7791c39086c93639c42ad6db43cb6e8a26dc6a1bde2bc53976a940c0dd77c9","observation_id":"28e4f11c-d675-4fef-b678-360e2fcb902d","resolution":{"observed_at":"2026-08-06T23:03:04.924942Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-06T21:13:12.849806Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00711","last_updated":"2025-07-01T12:14:22Z","snapshot_observed_at":"2026-08-13T17:27:22.573406Z","submitted_at":"2025-07-01T12:14:22Z","title":"Large Reasoning Models are not thinking straight: on the unreliability of thinking trajectories","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T21:13:12.849806Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2507.00711"},"observation_digest":"sha256:f2dda19b6f558bb8ae5c9847c1d1501121ce1594eb7a7868655ff4cf8db2358a","observation_id":"85e77101-b6ba-4207-bf9b-8c9ccf225721","resolution":{"observed_at":"2026-08-06T21:13:12.849806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-06T17:46:17.561067Z","title":"Transcoders Find Interpretable LLM Feature Circuits , 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10106","last_updated":"2025-07-14T09:45:34Z","snapshot_observed_at":"2026-08-21T23:36:55.612929Z","submitted_at":"2025-07-14T09:45:34Z","title":"BlueGlass: A Framework for Composite AI Safety","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T17:46:17.561067Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2507.10106"},"observation_digest":"sha256:72beee9cb91ad8361d0af9870a867202a53a74f562a4b434d04e30dbd82709bc","observation_id":"45d1f631-5cf5-46aa-bc47-32db5aa3e311","resolution":{"observed_at":"2026-08-06T17:46:17.561067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-05T18:47:45.265327Z","title":"& Nanda, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18235","last_updated":"2025-08-20T00:57:21Z","snapshot_observed_at":"2026-08-19T23:45:05.514496Z","submitted_at":"2025-08-20T00:57:21Z","title":"Sealing The Backdoor: Unlearning Adversarial Text Triggers In Diffusion Models Using Knowledge Distillation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T18:47:45.265327Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2508.18235"},"observation_digest":"sha256:dbefde711227986e72c44b0b0b55707ae972e1ca955bcb0c1d2031a48bf429de","observation_id":"ae07df43-5c5b-4ada-88af-d3dc7ad647cd","resolution":{"observed_at":"2026-08-05T18:47:45.265327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-15T16:52:36.127974Z","title":"Transcoders find interpretable llm feature circuits","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.20279","last_updated":"2025-08-27T21:22:01Z","snapshot_observed_at":"2026-08-20T06:10:40.004236Z","submitted_at":"2025-08-27T21:22:01Z","title":"How Multimodal LLMs Solve Image Tasks: A Lens on Visual Grounding, Task Reasoning, and Answer Decoding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:36.127974Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2508.20279"},"observation_digest":"sha256:5fa5a6dee4c644578ce1472e17bb0aaf86389a412697d05bead30009f09c8161","observation_id":"7dfd39f7-2da9-4227-b077-c9105219996a","resolution":{"observed_at":"2026-08-15T16:52:36.127974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-03T12:29:39.563314Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.02896","last_updated":"2026-06-26T05:19:31Z","snapshot_observed_at":"2026-08-16T19:03:04.537226Z","submitted_at":"2026-01-06T10:34:14Z","title":"Bridging Mechanistic Interpretability and Prompt Engineering with Gradient Ascent for Interpretable Persona Control","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T12:29:39.563314Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2601.02896"},"observation_digest":"sha256:6dea753424d5db47b0a99105a8990323529acaf144de18595ce5fdc6a8e43778","observation_id":"b8f9e34c-0dec-4fe2-bf92-56b08729be5e","resolution":{"observed_at":"2026-08-03T12:29:39.563314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":"2406.11944","doi":"10.48550/arxiv.2406.11944","metadata_source":"pith","pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transcoders Find Interpretable LLM Feature Circuits","venue":"cs.LG","work_id":"36a1b61a-64ca-4af5-b0c6-52d525c24c80","year":2024},"citing_paper":{"arxiv_id":"2604.07729","last_updated":"2026-04-09T02:25:17Z","snapshot_observed_at":"2026-08-02T17:43:45.091456Z","submitted_at":"2026-04-09T02:25:17Z","title":"Emotion Concepts and their Function in a Large Language Model","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T18:03:52.210931Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2604.07729"},"observation_digest":"sha256:afb0c9c407b8a1d4c5b0c6f12195f264163dfbcff30df0d2b8b462fd8b41e829","observation_id":"02ca933a-765e-4aa0-854d-013d0dba4500","resolution":{"observed_at":"2026-05-11T05:35:57.943307Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":"2406.11944","doi":"10.48550/arxiv.2406.11944","metadata_source":"pith","pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transcoders Find Interpretable LLM Feature Circuits","venue":"cs.LG","work_id":"36a1b61a-64ca-4af5-b0c6-52d525c24c80","year":2024},"citing_paper":{"arxiv_id":"2604.19260","last_updated":"2026-04-21T09:21:14Z","snapshot_observed_at":"2026-08-15T02:14:33.765960Z","submitted_at":"2026-04-21T09:21:14Z","title":"Understanding the Mechanism of Altruism in Large Language Models","version":1},"reference_index":236,"source":"arxiv_source","source_observed_at":"2026-05-10T01:36:50.329664Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2604.19260"},"observation_digest":"sha256:4a18c9a535ec06165996d3f7f0db203b35626caede526f0d583c82740598866f","observation_id":"b1e3d4f8-a0ed-472e-ac93-16fc02ebc1dc","resolution":{"observed_at":"2026-05-11T13:31:02.317778Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":"2406.11944","doi":"10.48550/arxiv.2406.11944","metadata_source":"pith","pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transcoders Find Interpretable LLM Feature Circuits","venue":"cs.LG","work_id":"36a1b61a-64ca-4af5-b0c6-52d525c24c80","year":2024},"citing_paper":{"arxiv_id":"2605.05907","last_updated":"2026-05-07T09:17:47Z","snapshot_observed_at":"2026-08-14T06:27:32.096989Z","submitted_at":"2026-05-07T09:17:47Z","title":"Decoding Alignment without Encoding Alignment: A critique of similarity analysis in neuroscience","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-08T03:30:33.288849Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2605.05907"},"observation_digest":"sha256:db3419a130175cd69060f25ce2f55a54c974dab67b7569bc6efadb8d0513300f","observation_id":"cb8bc351-cdbe-4d14-a2bc-2b64568af97d","resolution":{"observed_at":"2026-05-09T00:24:28.670130Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":"2406.11944","doi":"10.48550/arxiv.2406.11944","metadata_source":"pith","pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transcoders Find Interpretable LLM Feature Circuits","venue":"cs.LG","work_id":"36a1b61a-64ca-4af5-b0c6-52d525c24c80","year":2024},"citing_paper":{"arxiv_id":"2605.06494","last_updated":"2026-05-07T16:15:16Z","snapshot_observed_at":"2026-08-13T15:40:07.078663Z","submitted_at":"2026-05-07T16:15:16Z","title":"From Token Lists to Graph Motifs: Weisfeiler-Lehman Analysis of Sparse Autoencoder Features","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T09:41:01.775116Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2605.06494"},"observation_digest":"sha256:6d179007f8204c7c8aa1cb821159d397d78bdbb2823e22b0d978e0d776591fc0","observation_id":"564dfb56-d1c4-4d0b-a39d-2fd46d858fcb","resolution":{"observed_at":"2026-05-11T20:16:11.055181Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":"2406.11944","doi":"10.48550/arxiv.2406.11944","metadata_source":"pith","pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transcoders Find Interpretable LLM Feature Circuits","venue":"cs.LG","work_id":"36a1b61a-64ca-4af5-b0c6-52d525c24c80","year":2024},"citing_paper":{"arxiv_id":"2605.08934","last_updated":"2026-06-16T20:17:16Z","snapshot_observed_at":"2026-08-22T00:14:49.295746Z","submitted_at":"2026-05-09T13:08:07Z","title":"From Mechanistic to Compositional Interpretability","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-12T02:42:26.173782Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2605.08934"},"observation_digest":"sha256:67163d0e0b1fa84afbb95891979657c349a596e5f9f66501b033689e4a2ca6b8","observation_id":"2805d20e-ad21-4380-bcd2-276cf7b4d5fe","resolution":{"observed_at":"2026-05-12T02:46:18.555932Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":"2406.11944","doi":"10.48550/arxiv.2406.11944","metadata_source":"pith","pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transcoders Find Interpretable LLM Feature Circuits","venue":"cs.LG","work_id":"36a1b61a-64ca-4af5-b0c6-52d525c24c80","year":2024},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-20T21:49:47.934339Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:a45d32edb108748ed7b04a600e8ff95cb1bb707001f4af8c369a3e0b75e4e221","observation_id":"53c7f48d-b347-45eb-8d35-4ce21ec90d9e","resolution":{"observed_at":"2026-05-20T21:53:47.242717Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":"2406.11944","doi":"10.48550/arxiv.2406.11944","metadata_source":"pith","pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transcoders Find Interpretable LLM Feature Circuits","venue":"cs.LG","work_id":"36a1b61a-64ca-4af5-b0c6-52d525c24c80","year":2024},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-21T07:46:41.159688Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:dfdb907f9f37af2afb466178683652e82a9ae38bf663d2369c86ee2e10dad609","observation_id":"86342e52-49f8-45e7-89d4-378414b619c6","resolution":{"observed_at":"2026-05-21T07:49:50.160301Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":"2406.11944","doi":"10.48550/arxiv.2406.11944","metadata_source":"pith","pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transcoders Find Interpretable LLM Feature Circuits","venue":"cs.LG","work_id":"36a1b61a-64ca-4af5-b0c6-52d525c24c80","year":2024},"citing_paper":{"arxiv_id":"2605.22719","last_updated":"2026-05-21T16:55:27Z","snapshot_observed_at":"2026-08-18T11:46:06.648778Z","submitted_at":"2026-05-21T16:55:27Z","title":"Reading Task Failure Off the Activations: A Sparse-Feature Audit of GPT-2 Small on Indirect Object Identification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T07:42:48.816730Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2605.22719"},"observation_digest":"sha256:c10838fa7b9901361fd51498c757b650ba26c5aab06357e581514c6bbef57ce0","observation_id":"e60af32d-7b8b-4a3a-9ba8-67e40602853a","resolution":{"observed_at":"2026-05-22T07:44:42.756151Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":"2406.11944","doi":"10.48550/arxiv.2406.11944","metadata_source":"pith","pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transcoders Find Interpretable LLM Feature Circuits","venue":"cs.LG","work_id":"36a1b61a-64ca-4af5-b0c6-52d525c24c80","year":2024},"citing_paper":{"arxiv_id":"2605.24279","last_updated":"2026-05-22T23:13:21Z","snapshot_observed_at":"2026-08-21T02:40:27.019643Z","submitted_at":"2026-05-22T23:13:21Z","title":"ContextEcho: A Benchmark for Persona Drift in Long Agentic-Coding Sessions","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T15:17:37.904831Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2605.24279"},"observation_digest":"sha256:01c507442347ae5e551006f2c35cf441773500a801a4ca922dfa2061be18322a","observation_id":"31f5b5fb-32e8-4f81-81f0-6a12c968de41","resolution":{"observed_at":"2026-06-30T15:34:48.510603Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":"2406.11944","doi":"10.48550/arxiv.2406.11944","metadata_source":"pith","pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transcoders Find Interpretable LLM Feature Circuits","venue":"cs.LG","work_id":"36a1b61a-64ca-4af5-b0c6-52d525c24c80","year":2024},"citing_paper":{"arxiv_id":"2605.24577","last_updated":"2026-05-23T13:37:59Z","snapshot_observed_at":"2026-08-06T00:55:19.919445Z","submitted_at":"2026-05-23T13:37:59Z","title":"Polymorphism Is Rotation: Operational Mechanistic Interpretability from a Two-Layer Transformer to Pythia-70m","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T14:10:42.640805Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2605.24577"},"observation_digest":"sha256:9109ee1a151f2f74a87ceae86d9153c8b10358fd104c80f0cc9f68e7047fd224","observation_id":"aec6e571-7567-496c-8720-770632b714cb","resolution":{"observed_at":"2026-06-30T14:14:45.542319Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":"2406.11944","doi":"10.48550/arxiv.2406.11944","metadata_source":"pith","pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transcoders Find Interpretable LLM Feature Circuits","venue":"cs.LG","work_id":"36a1b61a-64ca-4af5-b0c6-52d525c24c80","year":2024},"citing_paper":{"arxiv_id":"2605.29358","last_updated":"2026-05-28T04:57:47Z","snapshot_observed_at":"2026-08-13T14:53:56.384009Z","submitted_at":"2026-05-28T04:57:47Z","title":"Scaling Monosemanticity: Extracting Interpretable Features from Claude 3 Sonnet","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:04.813379Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2605.29358"},"observation_digest":"sha256:105d66c2b1bd2d9a58a8cf1cd818da4b50895e8dad7fb1dbd6867fb8dc97f47d","observation_id":"3ac811f4-7e2f-4f79-bca5-30038b4f1f63","resolution":{"observed_at":"2026-06-29T07:53:13.459937Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":"2406.11944","doi":"10.48550/arxiv.2406.11944","metadata_source":"pith","pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transcoders Find Interpretable LLM Feature Circuits","venue":"cs.LG","work_id":"36a1b61a-64ca-4af5-b0c6-52d525c24c80","year":2024},"citing_paper":{"arxiv_id":"2606.07414","last_updated":"2026-06-05T16:06:47Z","snapshot_observed_at":"2026-08-17T17:53:01.281961Z","submitted_at":"2026-06-05T16:06:47Z","title":"Sparsely gated tiny linear experts","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T22:49:49.299925Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2606.07414"},"observation_digest":"sha256:75f47c314f8058792f04a4659c9b6693b405fb5c4d0d8e207cd7d77f36d178d6","observation_id":"01004121-5282-4dc4-a141-4652f2c23ad2","resolution":{"observed_at":"2026-07-02T16:17:09.314503Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":"2406.11944","doi":"10.48550/arxiv.2406.11944","metadata_source":"pith","pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transcoders Find Interpretable LLM Feature Circuits","venue":"cs.LG","work_id":"36a1b61a-64ca-4af5-b0c6-52d525c24c80","year":2024},"citing_paper":{"arxiv_id":"2606.09940","last_updated":"2026-06-08T00:15:44Z","snapshot_observed_at":"2026-08-16T16:43:16.496362Z","submitted_at":"2026-06-08T00:15:44Z","title":"Interactions Between Crosscoder Features: A Compact Proofs Perspective","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-27T17:25:55.152823Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2606.09940"},"observation_digest":"sha256:c8dc56fcb9129ec9185f185d18aa5d27d1e37bf4e64a62ac202309084dfe9bf4","observation_id":"6d595113-8780-425b-914e-f9aa7c96e2f2","resolution":{"observed_at":"2026-07-03T00:07:28.669471Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":"2406.11944","doi":"10.48550/arxiv.2406.11944","metadata_source":"pith","pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transcoders Find Interpretable LLM Feature Circuits","venue":"cs.LG","work_id":"36a1b61a-64ca-4af5-b0c6-52d525c24c80","year":2024},"citing_paper":{"arxiv_id":"2607.07316","last_updated":"2026-07-08T12:04:38Z","snapshot_observed_at":"2026-08-15T02:54:06.272019Z","submitted_at":"2026-07-08T12:04:38Z","title":"Mechanistic Interpretability for Neural Networks: Circuits, Sparse Features and Symbolic Reasoning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-09T14:58:58.363330Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2607.07316"},"observation_digest":"sha256:e3bb54c50ce9cae45395f0382a8eeba51bf4c17362d8419ba72911cd3c7a792e","observation_id":"70c3af1d-2434-48eb-bc8a-6922bae50f2c","resolution":{"observed_at":"2026-07-09T15:06:18.057814Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-22T00:08:09.382061+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-02T10:39:47.713797Z","title":"Transcoders","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13047","last_updated":"2026-06-19T19:07:38Z","snapshot_observed_at":"2026-08-10T04:42:58.694391Z","submitted_at":"2026-06-19T19:07:38Z","title":"Targeted Recovery of Weight-Space Mechanisms From Neural Networks","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-02T10:39:47.713797Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2607.13047"},"observation_digest":"sha256:0f0955654657b3616cfdcba22210e1af107b1c8401163b0c0dfd28fd9ae86974","observation_id":"1dca91b4-4811-43b2-a629-62de8707da3d","resolution":{"observed_at":"2026-08-02T10:39:47.713797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-02T10:40:01.415862Z","title":"Transcoders Find Interpretable LLM Feature Circuits , November 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13047","last_updated":"2026-06-19T19:07:38Z","snapshot_observed_at":"2026-08-10T04:42:58.694391Z","submitted_at":"2026-06-19T19:07:38Z","title":"Targeted Recovery of Weight-Space Mechanisms From Neural Networks","version":1},"reference_index":156,"source":"arxiv_source","source_observed_at":"2026-08-02T10:40:01.415862Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2607.13047"},"observation_digest":"sha256:86e60cb6361ca63e40255a64051e2c020f4805d8624e84e721ca95cc8222bf28","observation_id":"b6f75f6e-e1b0-43d6-a9e3-fec9811898fd","resolution":{"observed_at":"2026-08-02T10:40:01.415862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-02T01:06:13.602698Z","title":"Transcoders","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.602698Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:f65e66cdd3366ea7c80c706c2997807ce9fe79bea1a5863b10dc56c9db591484","observation_id":"9b9bd103-8203-42ef-adc8-eda0accbfd16","resolution":{"observed_at":"2026-08-02T01:06:13.602698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-01T23:15:20.650998Z","title":"Transcoders find interpretable llm fea- ture circuits.Advances in Neural Information Processing Systems, 37:24375–24410, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15495","last_updated":"2026-07-16T22:54:30Z","snapshot_observed_at":"2026-08-19T09:54:53.193795Z","submitted_at":"2026-07-16T22:54:30Z","title":"Verbalizable Representations Form a Global Workspace in Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T23:15:20.650998Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2607.15495"},"observation_digest":"sha256:aac08f9d80392d3625199af5b4af8e3c87fc889c12086ecbc67cbfbae5c3a2c5","observation_id":"914133ed-5878-495d-985e-60fd8a0ad5e6","resolution":{"observed_at":"2026-08-01T23:15:20.650998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-01T20:58:51.267585Z","title":"Transcoders find interpretable llm feature circuits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16448","last_updated":"2026-07-17T18:47:31Z","snapshot_observed_at":"2026-08-14T19:26:18.674556Z","submitted_at":"2026-07-17T18:47:31Z","title":"Retrieval is Enough: Training-Free Interpretability with a Tool-Using Agent","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T20:58:51.267585Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2607.16448"},"observation_digest":"sha256:1e1c58fde452ccdd47e41bf073aeb6ec93cc29e6cd89f5c13d16c4219c71084e","observation_id":"54730b82-5245-4b7e-bd5e-c4fd189d1119","resolution":{"observed_at":"2026-08-01T20:58:51.267585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-15T14:51:45.393010Z","title":"Transcoders find interpretable LLM feature circuits.arXiv preprint arXiv:2406.11944,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03913","last_updated":"2026-08-04T16:40:48Z","snapshot_observed_at":"2026-08-21T05:47:55.976654Z","submitted_at":"2026-08-04T16:40:48Z","title":"Sparse Weight Decomposition for Efficient Circuit Extraction","version":1},"reference_index":2004,"source":"pdf_text","source_observed_at":"2026-08-15T14:51:45.393010Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2608.03913"},"observation_digest":"sha256:239b2844490909fa7335e23dbd6e1e12ee82e812ba7d1a2531c961c4c87adbe1","observation_id":"9b6cba91-b16a-4c16-b976-b1f8874741f8","resolution":{"observed_at":"2026-08-15T14:51:45.393010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-14T13:29:00.120325Z","title":"Transcoders find interpretable llm feature circuits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13337","last_updated":"2026-08-13T15:06:56Z","snapshot_observed_at":"2026-08-19T08:41:50.325589Z","submitted_at":"2026-08-13T15:06:56Z","title":"Where You Measure Decides What You Measure: Position Selection in Ablation-Based SAE Evaluation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-14T13:29:00.120325Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2608.13337"},"observation_digest":"sha256:902cb3e8762a866380bd09adafd070dfcee2ff6a59c1c7bf180e7e09835c481d","observation_id":"e2c8b7a4-14b2-435e-b6d2-227558dc75df","resolution":{"observed_at":"2026-08-14T13:29:00.120325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.11944/citation-record","integrity":"/paper/2406.11944/integrity","json":"/paper/2406.11944/citation-record.json","paper":"/paper/2406.11944"},"outbound":[],"paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 40 inbound Pith citation observations for arXiv:2406.11944."}