{"as_of":"2026-08-22T04:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7c13e21aebed62640bfe1720c31b7f7894f48a747fa0acdd7cb79cb55348b554","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T22:24:53.899236Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:51:54.930894Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T00:07:28.632106Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18823","snapshot_observed_at":"2026-08-15T19:51:54.930894Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.14704","last_updated":"2025-06-17T16:42:54Z","snapshot_observed_at":"2026-08-20T04:55:31.087477Z","submitted_at":"2025-06-17T16:42:54Z","title":"Capacity Matters: a Proof-of-Concept for Transformer Memorization on Real-World Data","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T19:51:54.930894Z"},"links":{"cited_paper":"/paper/2501.18823","citing_paper":"/paper/2506.14704"},"observation_digest":"sha256:066b2ea651031fe53a073bc0dbe1b58270cb82fdf595120f88b2bd0e7e59d8c1","observation_id":"d946496c-4574-4620-ba8c-415dd49173f8","resolution":{"observed_at":"2026-08-15T19:51:54.930894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18823","snapshot_observed_at":"2026-08-05T18:47:45.267469Z","title":"& Belrose, N","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.18235","last_updated":"2025-08-20T00:57:21Z","snapshot_observed_at":"2026-08-19T23:45:05.514496Z","submitted_at":"2025-08-20T00:57:21Z","title":"Sealing The Backdoor: Unlearning Adversarial Text Triggers In Diffusion Models Using Knowledge Distillation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T18:47:45.267469Z"},"links":{"cited_paper":"/paper/2501.18823","citing_paper":"/paper/2508.18235"},"observation_digest":"sha256:f8fc3b7ac47a0c89e4e0d4e5d92b23a8d7f6e71c534e765e076a881121f8a60c","observation_id":"bf2d350c-cb39-4c0f-a65c-3cbc13eb9773","resolution":{"observed_at":"2026-08-05T18:47:45.267469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"cited_work":{"arxiv_id":"2501.18823","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18823","snapshot_observed_at":"2026-07-03T00:07:28.632106Z","title":"Transcoders beat sparse autoencoders for interpretability","venue":null,"work_id":"2f44b43c-3ea9-45f1-9545-cab3349b6143","year":2025},"citing_paper":{"arxiv_id":"2511.01680","last_updated":"2026-07-15T14:09:50Z","snapshot_observed_at":"2026-08-15T09:23:09.739265Z","submitted_at":"2025-11-03T15:42:32Z","title":"Making Interpretable Discoveries from Unstructured Data: A High-Dimensional Multiple Hypothesis Testing Approach","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-18T01:56:50.978054Z"},"links":{"cited_paper":"/paper/2501.18823","citing_paper":"/paper/2511.01680"},"observation_digest":"sha256:ca701508c7a2095b28f6d3ae985c1102a6602bb78cafd44a89f455e9ae18073c","observation_id":"3dc1aede-4cea-4018-8c24-e849deda137a","resolution":{"observed_at":"2026-05-18T02:00:40.064145Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18823","snapshot_observed_at":"2026-08-04T00:23:29.105938Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability , 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.01680","last_updated":"2026-07-15T14:09:50Z","snapshot_observed_at":"2026-08-15T09:23:09.739265Z","submitted_at":"2025-11-03T15:42:32Z","title":"Making Interpretable Discoveries from Unstructured Data: A High-Dimensional Multiple Hypothesis Testing Approach","version":4},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T00:23:29.105938Z"},"links":{"cited_paper":"/paper/2501.18823","citing_paper":"/paper/2511.01680"},"observation_digest":"sha256:216030d64d15dfa4438d7879377b74ac5929821b8b58153a07b3f5c7b3a73230","observation_id":"c7f318a9-708d-40f5-bdcf-ec8586895f68","resolution":{"observed_at":"2026-08-04T00:23:29.105938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"cited_work":{"arxiv_id":"2501.18823","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18823","snapshot_observed_at":"2026-07-03T00:07:28.632106Z","title":"Transcoders beat sparse autoencoders for interpretability","venue":null,"work_id":"2f44b43c-3ea9-45f1-9545-cab3349b6143","year":2025},"citing_paper":{"arxiv_id":"2604.06495","last_updated":"2026-04-07T21:56:23Z","snapshot_observed_at":"2026-08-19T08:45:22.232584Z","submitted_at":"2026-04-07T21:56:23Z","title":"Improving Robustness In Sparse Autoencoders via Masked Regularization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T18:47:15.830063Z"},"links":{"cited_paper":"/paper/2501.18823","citing_paper":"/paper/2604.06495"},"observation_digest":"sha256:140f5d1735e7315dfe1d97a5d22172cb2d114f26ab4b2c12ffe421961de56c0c","observation_id":"cb10d04b-b467-4a0c-9798-ec2865a3e301","resolution":{"observed_at":"2026-05-10T23:55:51.706772Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"cited_work":{"arxiv_id":"2501.18823","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18823","snapshot_observed_at":"2026-07-03T00:07:28.632106Z","title":"Transcoders beat sparse autoencoders for interpretability","venue":null,"work_id":"2f44b43c-3ea9-45f1-9545-cab3349b6143","year":2025},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-05-14T20:53:40.666929Z"},"links":{"cited_paper":"/paper/2501.18823","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:edc8deb31ff408aef4ee99e62a7f652b4ec192d7cedc944ac27051d2f9a5647c","observation_id":"3d5a7cdd-308c-4eb7-aceb-ab156224698d","resolution":{"observed_at":"2026-05-14T20:59:28.558798Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"cited_work":{"arxiv_id":"2501.18823","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18823","snapshot_observed_at":"2026-07-03T00:07:28.632106Z","title":"Transcoders beat sparse autoencoders for interpretability","venue":null,"work_id":"2f44b43c-3ea9-45f1-9545-cab3349b6143","year":2025},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":2},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-05-15T04:59:11.877068Z"},"links":{"cited_paper":"/paper/2501.18823","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:3549f57373bc716461f23ff5a92ba948a9267242f5d22cc04f9b7e868b4ad54a","observation_id":"e9270133-f940-483f-bae7-05cf498133f4","resolution":{"observed_at":"2026-05-15T04:59:45.253775Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"cited_work":{"arxiv_id":"2501.18823","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18823","snapshot_observed_at":"2026-07-03T00:07:28.632106Z","title":"Transcoders beat sparse autoencoders for interpretability","venue":null,"work_id":"2f44b43c-3ea9-45f1-9545-cab3349b6143","year":2025},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":3},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-05-20T21:49:47.934339Z"},"links":{"cited_paper":"/paper/2501.18823","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:75a5a1a963a7ee1ce52306b43b202ea1c88a6629caa1742c123a65355bf27a86","observation_id":"3141c122-7565-4733-93fa-82bf691bff82","resolution":{"observed_at":"2026-05-20T21:53:47.213529Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"cited_work":{"arxiv_id":"2501.18823","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18823","snapshot_observed_at":"2026-07-03T00:07:28.632106Z","title":"Transcoders beat sparse autoencoders for interpretability","venue":null,"work_id":"2f44b43c-3ea9-45f1-9545-cab3349b6143","year":2025},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-21T07:46:41.159688Z"},"links":{"cited_paper":"/paper/2501.18823","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:2cd44288bee89f6eb72700d4bd1dd908c7f12d70217a3f1e551d0106f9316b78","observation_id":"ee2ed23b-0ccf-442a-8ca6-883847cd3c92","resolution":{"observed_at":"2026-05-21T07:49:50.090433Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"cited_work":{"arxiv_id":"2501.18823","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18823","snapshot_observed_at":"2026-07-03T00:07:28.632106Z","title":"Transcoders beat sparse autoencoders for interpretability","venue":null,"work_id":"2f44b43c-3ea9-45f1-9545-cab3349b6143","year":2025},"citing_paper":{"arxiv_id":"2605.21849","last_updated":"2026-05-21T00:46:01Z","snapshot_observed_at":"2026-08-03T04:39:11.733198Z","submitted_at":"2026-05-21T00:46:01Z","title":"Geometry-Adaptive Explainer for Faithful Dictionary-Based Interpretability under Distribution Shift","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-22T08:14:58.183289Z"},"links":{"cited_paper":"/paper/2501.18823","citing_paper":"/paper/2605.21849"},"observation_digest":"sha256:002570fb1651bbddd5a168e1eadfeabe8e8a969fe95b2f5010c5967875aa93ab","observation_id":"9c655d3f-e870-4ddb-81b2-5819a0ea2fad","resolution":{"observed_at":"2026-05-22T08:16:16.144308Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"cited_work":{"arxiv_id":"2501.18823","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18823","snapshot_observed_at":"2026-07-03T00:07:28.632106Z","title":"Transcoders beat sparse autoencoders for interpretability","venue":null,"work_id":"2f44b43c-3ea9-45f1-9545-cab3349b6143","year":2025},"citing_paper":{"arxiv_id":"2606.09940","last_updated":"2026-06-08T00:15:44Z","snapshot_observed_at":"2026-08-16T16:43:16.496362Z","submitted_at":"2026-06-08T00:15:44Z","title":"Interactions Between Crosscoder Features: A Compact Proofs Perspective","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-27T17:25:55.152823Z"},"links":{"cited_paper":"/paper/2501.18823","citing_paper":"/paper/2606.09940"},"observation_digest":"sha256:c3872cf8c4ea3209b342d353d99b8582576ccefa2108c4b98659335be0bc3dc0","observation_id":"12c2ecd1-63ed-4ae3-a766-263a3282c8b5","resolution":{"observed_at":"2026-07-03T00:07:28.633788Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18823","snapshot_observed_at":"2026-08-02T01:06:13.642977Z","title":"Transcoders","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.642977Z"},"links":{"cited_paper":"/paper/2501.18823","citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:f4f72a4c36959f12836b988fc224daf627c1e5190fa8b370905ec061de628892","observation_id":"1f9592c2-90e0-4c90-8058-7b157fe71aae","resolution":{"observed_at":"2026-08-02T01:06:13.642977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18823","snapshot_observed_at":"2026-08-01T23:15:30.763794Z","title":"Transcoders beat sparse autoencoders for interpretability.arXiv preprint arXiv:2501.18823, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15495","last_updated":"2026-07-16T22:54:30Z","snapshot_observed_at":"2026-08-19T09:54:53.193795Z","submitted_at":"2026-07-16T22:54:30Z","title":"Verbalizable Representations Form a Global Workspace in Language Models","version":1},"reference_index":140,"source":"pdf_text","source_observed_at":"2026-08-01T23:15:30.763794Z"},"links":{"cited_paper":"/paper/2501.18823","citing_paper":"/paper/2607.15495"},"observation_digest":"sha256:3a2936b12da1f1dd1b9c7236290cc8f6e3e8c821fbc96ec2a018cbb8edc8d5bb","observation_id":"0c532033-01e8-40d0-9379-caa8dc15910d","resolution":{"observed_at":"2026-08-01T23:15:30.763794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18823","snapshot_observed_at":"2026-08-15T15:04:48.266417Z","title":"Transcoders","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.266417Z"},"links":{"cited_paper":"/paper/2501.18823","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:85b52d7b92239e0511984a1999d2c4345512cf69ca78d53c729ea8ba75c91510","observation_id":"543bdd20-a41a-4afd-a618-ce2f082335bd","resolution":{"observed_at":"2026-08-15T15:04:48.266417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18823","snapshot_observed_at":"2026-08-14T04:21:09.505809Z","title":"Transcoders beat sparse autoencoders for interpretability.arXiv preprint arXiv:2501.18823, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10172","last_updated":"2026-08-10T19:42:01Z","snapshot_observed_at":"2026-08-17T07:01:29.715682Z","submitted_at":"2026-08-10T19:42:01Z","title":"Intrinsic Structure: Spectral Identifiability for Mechanistic Interpretability","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T04:21:09.505809Z"},"links":{"cited_paper":"/paper/2501.18823","citing_paper":"/paper/2608.10172"},"observation_digest":"sha256:7b5a7c7b2d9ff5c11f6ce42f18a17a7900b1db5adcb42038c2edf3cc25f181e2","observation_id":"b39137c1-d6e6-4e27-838f-4d3f4bb6b6ac","resolution":{"observed_at":"2026-08-14T04:21:09.505809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.18823/citation-record","integrity":"/paper/2501.18823/integrity","json":"/paper/2501.18823/citation-record.json","paper":"/paper/2501.18823"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:53.779467Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.779467Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:7825ce79b8864518a115702137aaa3fa9fc368b9c522fac1447068c779aa4bce","observation_id":"ff980a68-7ac6-4f52-b33f-861499eda96b","resolution":{"observed_at":"2026-08-09T22:24:53.779467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:53.783908Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.783908Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:146300e15b8b387765d51888da3ce30d2500497fc9e139838e24b19f3b15b2f2","observation_id":"22ef0f91-5384-4edd-ae4b-0689fe697a6a","resolution":{"observed_at":"2026-08-09T22:24:53.783908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:53.787898Z","title":"Linear algebraic structure of word senses, with applications to polysemy","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.787898Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:be1d6086cc141f194c82070a59ea0c71d6e621fa0a1862ae01b29bbddfbafcaa","observation_id":"1deecc2a-75a9-4a21-8d97-7fc1af5964f5","resolution":{"observed_at":"2026-08-09T22:24:53.787898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11179","last_updated":"2024-10-15T01:38:03Z","snapshot_observed_at":"2026-08-16T13:09:22.337092Z","submitted_at":"2024-10-15T01:38:03Z","title":"Interpretability as Compression: Reconsidering SAE Explanations of Neural Activations with MDL-SAEs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11179","snapshot_observed_at":"2026-08-09T22:24:53.791376Z","title":"T., and Sharkey, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.791376Z"},"links":{"cited_paper":"/paper/2410.11179","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:5926c9305679077e8992006f65ced315e9be948607543c6ffc0323dc3ae156d8","observation_id":"f75f0885-0c9d-4757-85d2-b0dd53aa682d","resolution":{"observed_at":"2026-08-09T22:24:53.791376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07656","last_updated":"2025-03-01T07:16:47Z","snapshot_observed_at":"2026-08-16T13:10:49.939427Z","submitted_at":"2024-10-10T06:55:38Z","title":"Mechanistic Permutability: Match Features Across Layers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07656","snapshot_observed_at":"2026-08-09T22:24:53.794990Z","title":"Mechanistic permutability: Match features across layers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.794990Z"},"links":{"cited_paper":"/paper/2410.07656","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:cf9e54e6bcf6dbdb3476935cbefebf9cc49498699c7adf7cfac483aeec879d93","observation_id":"04ceac99-7411-4570-8fd5-1c8e73cd3969","resolution":{"observed_at":"2026-08-09T22:24:53.794990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:54.320564Z","title":"and Baraniuk, R","venue":null,"work_id":"31bb9d67-daec-4abb-9dca-739ec38da37a","year":2019},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.798270Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:c3df27f38e95146ba81e0efa627009fba590c9d916de8646c8a88d9c870592d6","observation_id":"2c92d59d-ecd3-48c4-bba3-55e9d361e7ac","resolution":{"observed_at":"2026-08-09T22:24:54.323697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:53.801561Z","title":"G., Bradley, H., O’Brien, K., Hallahan, E., Khan, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.801561Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:26461f8ad93d505cc4a891269893621b24d312de8a42d6d6bb5b3b35e76e0193","observation_id":"171141ac-5dd8-443d-9911-fbc3b5c474a8","resolution":{"observed_at":"2026-08-09T22:24:53.801561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:54.304351Z","title":"Language models can explain neurons in language models","venue":null,"work_id":"5a3f32d6-91fc-4927-a508-66aae3c1d899","year":2023},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.804649Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:113e5cf055d2a21161702aeca3cd7b348356685c5c82a8d43e2fc49b85aab359","observation_id":"183bc9a1-993c-46aa-a87f-aec5fa3beb1d","resolution":{"observed_at":"2026-08-09T22:24:54.307594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12312","last_updated":"2022-11-22T15:03:48Z","snapshot_observed_at":"2026-08-21T23:42:17.171723Z","submitted_at":"2022-11-22T15:03:48Z","title":"Interpreting Neural Networks through the Polytope Lens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12312","snapshot_observed_at":"2026-08-09T22:24:53.807886Z","title":"R., Millidge, B., Alfour, G., and Leahy, C","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.807886Z"},"links":{"cited_paper":"/paper/2211.12312","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:36846d893f687bd63972784769d449f2102a095be47597159c3a20827cf6909b","observation_id":"34ecd6ab-fc1a-4ff6-9fd1-d4953946937e","resolution":{"observed_at":"2026-08-09T22:24:53.807886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:54.293968Z","title":"E., Hume, T., Carter, S., Henighan, T., and Olah, C","venue":null,"work_id":"eb60e0e2-8ce5-4528-9099-5896fff30150","year":2023},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.811118Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:55652cb2554935d91af0f4753d8d3d1eac7ae6718605c634fcfe4d1ccf636f99","observation_id":"0e2286ff-1297-4bc4-b0e3-70a2126e340c","resolution":{"observed_at":"2026-08-09T22:24:54.297725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:54.284743Z","title":"L., Anil, C., Denison, C., Askell, A., Lasenby, R., Wu, Y., Kravec, S., Schiefer, N., Maxwell, T., Joseph, N., Tamkin, A., Nguyen, K., McLean, B., Burke, J","venue":null,"work_id":"63c25148-3c13-4a4d-b556-13de3a62b243","year":2023},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.813960Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:ab0970c325274dc30d2594c253bb495647455269a3e94af87c5472e3ea7615f7","observation_id":"5a83ef4a-c769-4058-bbf5-cf57a4232c51","resolution":{"observed_at":"2026-08-09T22:24:54.287944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:54.275672Z","title":"Learning multi-level features with matryoshka saes","venue":null,"work_id":"348fb698-1e3f-4a7b-ba10-22261216c809","year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.816783Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:7b180f0b95636cbd1da990bd453b43192a8fb9bcb2639def7a684f1b544c23ff","observation_id":"c0e40d2d-ca77-4bc1-be06-adb47144d086","resolution":{"observed_at":"2026-08-09T22:24:54.278822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-20T16:31:53.975704Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-09T22:24:53.819540Z","title":"Batchtopk sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.819540Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:0a306c935bb4aa37c4f6af032d2ebe1885b68c357234f4e0d99ae1fadeae02be","observation_id":"32562f45-8c26-4456-af7b-cfbeb6f2ac8f","resolution":{"observed_at":"2026-08-09T22:24:53.819540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:53.822566Z","title":"A is for absorption: Studying feature splitting and absorption in sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.822566Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:d241c26e4d36cab8b7e9c7a0b2ff034e6061f351a8b31453adf0a97ce110db19","observation_id":"389ab1e5-e18c-4de9-867d-e47d9a8d8a5a","resolution":{"observed_at":"2026-08-09T22:24:53.822566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:54.265331Z","title":"Redpajama: an open dataset for training large language models, 2023","venue":null,"work_id":"9a606f0b-06b9-49af-9c3c-ce816c612e68","year":2023},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.825215Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:8d77cb9acb5936f0f261391cfcdfbf1f80b216d1a22c856c9b1211a187f944e1","observation_id":"a8eeb20a-a837-4c55-896a-7ecb026afc01","resolution":{"observed_at":"2026-08-09T22:24:54.268578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-09T22:24:53.827765Z","title":"N., Lynch, A., Heimersheim, S., and Garriga-Alonso, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.827765Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:a5a8c40cf4d1df78148118164147f4d9f53c21442bf10e1c8ed72a6799966697","observation_id":"69061fed-e49d-4c2b-8b98-dd09645abde2","resolution":{"observed_at":"2026-08-09T22:24:53.827765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-09T22:24:53.830800Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.830800Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:ccd5af828711f11ef9dc9d1262cf3895bf066603f5e7d756eb695cfa5cb8cedb","observation_id":"395cc7e1-7f8b-4705-9253-755d0aa90007","resolution":{"observed_at":"2026-08-09T22:24:53.830800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-09T22:24:53.833482Z","title":"Transcoders find interpretable llm feature circuits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.833482Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:6b2a625b9a81bead4eb9bb814be095d3e37a83565b7f29ee4bf0d3041d5ac986","observation_id":"0e814619-2107-4595-9062-a38af8b9a3cd","resolution":{"observed_at":"2026-08-09T22:24:53.833482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10652","last_updated":"2022-09-21T20:49:26Z","snapshot_observed_at":"2026-08-16T21:36:28.067615Z","submitted_at":"2022-09-21T20:49:26Z","title":"Toy Models of Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10652","snapshot_observed_at":"2026-08-09T22:24:53.836288Z","title":"Toy models of superposition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.836288Z"},"links":{"cited_paper":"/paper/2209.10652","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:fa59b26ceabac15ad08182030067e65d4cbfb21b9a6ee2bfe1e489a023705911","observation_id":"df94c201-6434-452c-b0bd-d3f2697fb5e2","resolution":{"observed_at":"2026-08-09T22:24:53.836288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14670","last_updated":"2025-03-25T17:00:02Z","snapshot_observed_at":"2026-08-21T03:26:06.481130Z","submitted_at":"2024-10-18T17:58:53Z","title":"Decomposing The Dark Matter of Sparse Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14670","snapshot_observed_at":"2026-08-09T22:24:53.839060Z","title":"Decomposing the dark matter of sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.839060Z"},"links":{"cited_paper":"/paper/2410.14670","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:6dbe86d5d84e34545d9755ca76ee81fb2f607c33c5cd3c25fa84c19625958695","observation_id":"1633fff6-25b8-475b-910f-d95bf28d11e6","resolution":{"observed_at":"2026-08-09T22:24:53.839060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-09T22:24:53.841938Z","title":"The pile: An 800gb dataset of diverse text for language modeling","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.841938Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:9bea273db335a3bc382ce44a6d10e92309f5bb5ba6fb2004fcc4ace2b601c4ee","observation_id":"0ecd7d15-425d-4c92-8168-8b4d661dbcc7","resolution":{"observed_at":"2026-08-09T22:24:53.841938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04093","last_updated":"2024-06-06T14:10:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-06T14:10:12Z","title":"Scaling and evaluating sparse autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04093","snapshot_observed_at":"2026-08-09T22:24:53.844765Z","title":"D., Tillman, H., Goh, G., Troll, R., Radford, A., Sutskever, I., Leike, J., and Wu, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.844765Z"},"links":{"cited_paper":"/paper/2406.04093","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:54fbad34681d1f72eb4726832bb2d2a8d4e5d8031c5ad2cf5c3bd4365ba2f922","observation_id":"e92cfc6f-07db-40e1-af73-6b5443be6c4d","resolution":{"observed_at":"2026-08-09T22:24:53.844765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:53.847517Z","title":"Openwebtext corpus","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.847517Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:efc96f50f657784c894b54c74b074fb088ad86e7827756a8c7c9cd80902eca84","observation_id":"cbe171f0-b4e3-422f-9576-ec5e485081a1","resolution":{"observed_at":"2026-08-09T22:24:53.847517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-09T22:24:53.850177Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.850177Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:329383dfb07647694d584d770297254ba0eaf973bb319417fb8713824d2067e6","observation_id":"a3a12753-7b4d-4ee9-b5d2-14881b336d8d","resolution":{"observed_at":"2026-08-09T22:24:53.850177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01610","last_updated":"2023-06-02T21:52:17Z","snapshot_observed_at":"2026-08-17T05:06:29.353999Z","submitted_at":"2023-05-02T17:13:55Z","title":"Finding Neurons in a Haystack: Case Studies with Sparse Probing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.01610","snapshot_observed_at":"2026-08-09T22:24:53.852861Z","title":"Finding neurons in a haystack: Case studies with sparse probing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.852861Z"},"links":{"cited_paper":"/paper/2305.01610","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:5e2aa769c2a5092ca70e6b7ab7dd73b122302437ef077902c9b8d23e795b8d6d","observation_id":"8ebfe189-4b58-4945-9c96-e72c608cf0cc","resolution":{"observed_at":"2026-08-09T22:24:53.852861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-09T22:24:53.855675Z","title":"C., Kheirkhah, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.855675Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:11c098f485908b820a6c7ab5c2ca46f781df23bdea919c8ff352363119242132","observation_id":"0b284469-f521-48a7-8ea5-57e1dedfdef2","resolution":{"observed_at":"2026-08-09T22:24:53.855675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:54.249670Z","title":"and Templeton, A","venue":null,"work_id":"97181580-7f8d-4ee3-9163-ac73a031ea99","year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.858586Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:682fbbab5709c964bd7c47c52c7b71ecea7cc2161b95c5cd6136f7723716f6c1","observation_id":"818139f1-5ca3-4a22-a4e3-edec26335ba1","resolution":{"observed_at":"2026-08-09T22:24:54.252911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:54.240169Z","title":"Open source automated interpretability for sparse autoencoder features, July 2024","venue":null,"work_id":"4a30aedd-5bbc-4a78-8511-7129651f161c","year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.861581Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:6477a71688dc57d60485e19351e889fc66288bf6fcd59d8a0d85b739b76d13a7","observation_id":"0ce159be-dc41-4fcf-896d-9e2740c0b022","resolution":{"observed_at":"2026-08-09T22:24:54.243477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:54.229657Z","title":"Saebench: A comprehensive benchmark for sparse autoencoders, 2024","venue":null,"work_id":"357a5c14-ecff-4f93-a078-8433bc4ad67a","year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.864525Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:1a49c187603166acac0254776ccff8ee9ed5fde2efdae730531b78a42e69acf1","observation_id":"d99addce-95f8-44be-894f-8742ecf48bff","resolution":{"observed_at":"2026-08-09T22:24:54.233599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-09T22:24:53.867368Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.867368Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:780ab0a371072b4efa4e09cc9bac99f0813a8b4b1cd6d31cf05a2bc971594103","observation_id":"5b7092ab-42a5-4337-b731-bfb30cf0c284","resolution":{"observed_at":"2026-08-09T22:24:53.867368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:54.219992Z","title":"dictionary\\_learning repository, 2023","venue":null,"work_id":"26d3781d-b32f-45cc-ade8-0deb5793b5ce","year":2023},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.870103Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:9530425861350b728d6ee454de347d58c83dbe464c5c3c37a15f42d25c37e17e","observation_id":"837accc0-d372-44ad-95a2-468329773b9b","resolution":{"observed_at":"2026-08-09T22:24:54.222989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19647","last_updated":"2025-03-27T05:44:45Z","snapshot_observed_at":"2026-08-14T07:35:01.333549Z","submitted_at":"2024-03-28T17:56:07Z","title":"Sparse Feature Circuits: Discovering and Editing Interpretable Causal Graphs in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19647","snapshot_observed_at":"2026-08-09T22:24:53.872872Z","title":"J., Belinkov, Y., Bau, D., and Mueller, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.872872Z"},"links":{"cited_paper":"/paper/2403.19647","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:055832c5ee8e25f660e48dfd2893a461b09cc5666b347ab67e216adc2f1987f3","observation_id":"641a3294-e646-4bd9-8b15-5d1d54510444","resolution":{"observed_at":"2026-08-09T22:24:53.872872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:53.876083Z","title":"and Black, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.876083Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:331991ed34a698f68da0db782bd3b5a8f6b720b5eeab2e416200b96e67028da0","observation_id":"e3aeeeab-a92a-4579-8e2e-1c08ed9acdea","resolution":{"observed_at":"2026-08-09T22:24:53.876083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:54.204078Z","title":"Matryoshka sparse autoencoders","venue":null,"work_id":"d561f24b-fed8-403b-8a94-43cc580f35c2","year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.878944Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:b01384fa84380d93de913750548192d1c2ec89d27218d3078f876c66e4252fe7","observation_id":"ebddf325-94da-4cc4-b676-e1c83342243a","resolution":{"observed_at":"2026-08-09T22:24:54.207509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:53.881587Z","title":"Zoom in: An introduction to circuits","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.881587Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:542c641324897a75b1ea5893b2b3ce60336df388eaf5870a8b42b3f712ee18a8","observation_id":"c73c176d-a85c-43b6-aed6-04752cfb4e1c","resolution":{"observed_at":"2026-08-09T22:24:53.881587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13928","last_updated":"2025-08-06T13:47:10Z","snapshot_observed_at":"2026-08-16T13:08:17.757544Z","submitted_at":"2024-10-17T17:56:01Z","title":"Automatically Interpreting Millions of Features in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13928","snapshot_observed_at":"2026-08-09T22:24:53.884852Z","title":"Automatically interpreting millions of features in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.884852Z"},"links":{"cited_paper":"/paper/2410.13928","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:e45b72f3087128bdbcceac6ec9e70a56d10a23bd5bf87351bdd4d5d6f8283fd1","observation_id":"8d3227a6-362c-4f27-9081-ab790f79be4d","resolution":{"observed_at":"2026-08-09T22:24:53.884852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:53.887575Z","title":"B., Lozhkov, A., Mitchell, M., Raffel, C., Werra, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.887575Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:c8c8123ec1f874f25641563542cda2077d68dc16bae1f84be66590ec7c9ae6e1","observation_id":"e5345284-d47d-47ee-8b94-e6238ff5ea68","resolution":{"observed_at":"2026-08-09T22:24:53.887575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14435","last_updated":"2024-08-01T17:42:04Z","snapshot_observed_at":"2026-08-08T18:10:15.134088Z","submitted_at":"2024-07-19T16:07:19Z","title":"Jumping Ahead: Improving Reconstruction Fidelity with JumpReLU Sparse Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14435","snapshot_observed_at":"2026-08-09T22:24:53.890411Z","title":"Jumping ahead: Improving reconstruction fidelity with jumprelu sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.890411Z"},"links":{"cited_paper":"/paper/2407.14435","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:e4facefc7377096b39d18a41ec5506bf3a0f27a9b3297e0bc720302d7b393d9e","observation_id":"68e6aca4-03a4-4a3a-89ba-c2b5f79cbd5b","resolution":{"observed_at":"2026-08-09T22:24:53.890411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-21T05:15:28.840279Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T22:24:53.893458Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ram \\'e , A., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.893458Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:cb0539db6c05c65e300d253d305a829a4855bae30c05d9980fa6b882198500f8","observation_id":"ae0c6696-fcc1-4806-8547-36b3c200c9f0","resolution":{"observed_at":"2026-08-09T22:24:53.893458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:54.188995Z","title":"Predicting future activations","venue":null,"work_id":"2846be6d-0a1d-4b03-b79f-a340cfee4ede","year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.896454Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:aef2fcaae77a03d20793abd31cd1073f509923cc227b5f2799fc14911d657bf1","observation_id":"a2122e0c-0eea-4d37-860a-88768c3e5d5c","resolution":{"observed_at":"2026-08-09T22:24:54.191982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:24:54.177900Z","title":"L., McDougall, C., MacDiarmid, M., Freeman, C","venue":null,"work_id":"d77c62c0-0d59-41f0-8f18-74305f11767d","year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.899236Z"},"links":{"citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:978e9bd3a57115ef236f6f5de68b6e68f97b6c06b92da3d9c75b803edb367209","observation_id":"d504b34f-91c6-413d-a3b8-897d9553d8ef","resolution":{"observed_at":"2026-08-09T22:24:54.182000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 15 inbound Pith citation observations for arXiv:2501.18823."}