{"as_of":"2026-08-12T04:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a5e16a94b876f0370ff5adce6f6dbbfb57dd9e69c7920347f7d941171c54f12c","coverage":[{"denominator":9,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T19:45:04.047934Z","state":"measured"},{"denominator":73,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":73,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":64,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T14:55:01.953347Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":4,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-10T14:55:01.953347Z","title":"Batchtopk sparse autoencoders, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-11T14:59:46.617579Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.953347Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:8a175d793434f73c3614db6fd01ffdd971678e9faf1afb1b7e89a25c7ac5fab2","observation_id":"d30465e6-3b9d-4f7b-bb16-4213df4a7c54","resolution":{"observed_at":"2026-08-10T14:55:01.953347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-10T01:04:57.032998Z","title":"Batchtopk sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18052","last_updated":"2025-05-21T21:35:16Z","snapshot_observed_at":"2026-08-10T00:48:44.785512Z","submitted_at":"2025-01-29T23:29:47Z","title":"SAeUron: Interpretable Concept Unlearning in Diffusion Models with Sparse Autoencoders","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T01:04:57.032998Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2501.18052"},"observation_digest":"sha256:b767abb9160811effaa48cd04c646d118ab1f4a4b0548d6f6a2557d5600c6274","observation_id":"08cb6a92-6a7f-4276-abac-39cc8c4ad0d5","resolution":{"observed_at":"2026-08-10T01:04:57.032998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-09T22:24:53.819540Z","title":"Batchtopk sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-11T02:09:42.977983Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.819540Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:35a981d9b37d9d7cd54a27b10ec9083cc80f4f814d894a6c51ecde1503c4c495","observation_id":"32562f45-8c26-4456-af7b-cfbeb6f2ac8f","resolution":{"observed_at":"2026-08-09T22:24:53.819540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-09T20:18:30.572602Z","title":"Batchtopk sparse autoencoders","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.19406","last_updated":"2025-05-27T06:39:54Z","snapshot_observed_at":"2026-08-09T20:10:52.723666Z","submitted_at":"2025-01-31T18:59:16Z","title":"Low-Rank Adapting Models for Sparse Autoencoders","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T20:18:30.572602Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2501.19406"},"observation_digest":"sha256:dc014798340ac1ec97453c8d8edfb2ebd4d1c43620e7c7e0fe13878113aa8599","observation_id":"f4173e59-ba33-490e-b852-7c5a18de0ca5","resolution":{"observed_at":"2026-08-09T20:18:30.572602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-09T10:11:51.452310Z","title":"Batchtopk sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03032","last_updated":"2025-07-24T21:16:27Z","snapshot_observed_at":"2026-08-10T02:30:42.809107Z","submitted_at":"2025-02-05T09:39:34Z","title":"Analyze Feature Flow to Enhance Interpretation and Steering in Language Models","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T10:11:51.452310Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2502.03032"},"observation_digest":"sha256:b9d79becedb895c02b3cb3c35d96684f694ced20327a3c0b1edf953cf6f24150","observation_id":"4d55c472-3b55-4205-a041-12f6c98efdfd","resolution":{"observed_at":"2026-08-09T10:11:51.452310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-08T21:12:13.806500Z","title":"Batchtopk sparse autoencoders","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-08-10T11:45:33.745155Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:13.806500Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2502.04878"},"observation_digest":"sha256:987c557c0d807e3b68efd8122859fe0afefce18a1bbc24a2ad610b1d4e16774a","observation_id":"5fe28006-0be0-4138-b8f7-57db0079805f","resolution":{"observed_at":"2026-08-08T21:12:13.806500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-07T14:02:58.976794Z","title":"Batchtopk sparse autoencoders.arXiv preprint arXiv:2412.06410, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20254","last_updated":"2025-05-26T17:31:36Z","snapshot_observed_at":"2026-08-10T22:41:34.301829Z","submitted_at":"2025-05-26T17:31:36Z","title":"Position: Mechanistic Interpretability Should Prioritize Feature Consistency in SAEs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:02:58.976794Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2505.20254"},"observation_digest":"sha256:46763f7f7929b919f3df92822e2a08c9bb9fbebd6aab7d0b76cd9a003025868a","observation_id":"6a38c3d4-af46-42a5-87b0-f690c11b3c21","resolution":{"observed_at":"2026-08-07T14:02:58.976794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-07T13:11:37.858200Z","title":"Batchtopk sparse autoencoders,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22506","last_updated":"2025-05-28T15:54:33Z","snapshot_observed_at":"2026-08-10T17:59:09.513021Z","submitted_at":"2025-05-28T15:54:33Z","title":"Sparsification and Reconstruction from the Perspective of Representation Geometry","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:37.858200Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2505.22506"},"observation_digest":"sha256:d5187c50582beef11b284c689f95154bd80b05ea15ee0cb2eaf86336571ed5aa","observation_id":"50f392a6-1331-4668-b790-836ee4e1ae44","resolution":{"observed_at":"2026-08-07T13:11:37.858200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-07T12:35:25.286393Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24473","last_updated":"2025-06-05T11:42:24Z","snapshot_observed_at":"2026-08-09T06:27:07.999203Z","submitted_at":"2025-05-30T11:20:44Z","title":"Train One Sparse Autoencoder Across Multiple Sparsity Budgets to Preserve Interpretability and Accuracy","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:25.286393Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2505.24473"},"observation_digest":"sha256:67ebd57fb8aa82122f3cfe0b48f95e91e805ced0f2db314426dffa430f2deb17","observation_id":"853c427a-e857-45d2-8e00-188440d1c678","resolution":{"observed_at":"2026-08-07T12:35:25.286393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-07T13:25:57.848328Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00041","last_updated":"2025-08-27T13:45:53Z","snapshot_observed_at":"2026-08-09T21:03:26.575507Z","submitted_at":"2025-05-28T02:50:17Z","title":"Decoding Dense Embeddings: Sparse Autoencoders for Interpreting and Discretizing Dense Retrieval","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:57.848328Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2506.00041"},"observation_digest":"sha256:0a7f3d7b2fc76de9eb7a6984f60eca7f20ce4b82d8fd9ea098bf42d06fa89a62","observation_id":"74ca310b-cf80-4390-9025-674d44e0d18d","resolution":{"observed_at":"2026-08-07T13:25:57.848328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-07T11:56:15.144035Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01197","last_updated":"2025-06-01T22:20:07Z","snapshot_observed_at":"2026-08-10T06:48:33.503354Z","submitted_at":"2025-06-01T22:20:07Z","title":"Incorporating Hierarchical Semantics in Sparse Autoencoder Architectures","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:15.144035Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2506.01197"},"observation_digest":"sha256:60d79b62cee8e618c7d79ec0e33c141e2814d8166e999f9e984cda4009a5a6b5","observation_id":"b827ef89-da76-40a5-b339-6dedee4ee913","resolution":{"observed_at":"2026-08-07T11:56:15.144035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-06T17:46:16.400548Z","title":"BatchTopK Sparse Autoencoders , 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10106","last_updated":"2025-07-14T09:45:34Z","snapshot_observed_at":"2026-08-07T07:18:38.132008Z","submitted_at":"2025-07-14T09:45:34Z","title":"BlueGlass: A Framework for Composite AI Safety","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T17:46:16.400548Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2507.10106"},"observation_digest":"sha256:e6970b3cf8299d7d5b772cac1eb13dd0b184227cf5ab5a22fa2cd0dca446bb09","observation_id":"e744d89e-f625-48bd-9a2d-944b37cf8872","resolution":{"observed_at":"2026-08-06T17:46:16.400548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-06T16:40:41.088549Z","title":"BatchTopK sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12950","last_updated":"2025-07-18T09:19:19Z","snapshot_observed_at":"2026-08-08T08:02:10.889574Z","submitted_at":"2025-07-17T09:43:20Z","title":"Insights into a radiology-specialised multimodal large language model with sparse autoencoders","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T16:40:41.088549Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2507.12950"},"observation_digest":"sha256:504f986aa61851f180fa04e9a3895bc22f8125d31d2876d13949dbca510ab557","observation_id":"97c91098-ec70-4e7f-9958-de81d8bb0022","resolution":{"observed_at":"2026-08-06T16:40:41.088549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-06T16:40:28.594279Z","title":"Hoagy Cunningham, Aidan Ewart, Logan Riggs, Robert Huben, and Lee Sharkey","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12990","last_updated":"2025-07-17T10:57:49Z","snapshot_observed_at":"2026-08-08T10:53:21.043716Z","submitted_at":"2025-07-17T10:57:49Z","title":"Teach Old SAEs New Domain Tricks with Boosting","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T16:40:28.594279Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2507.12990"},"observation_digest":"sha256:797b70a17381a6adca80486cb18b2b84c2a0b3225f10438320e075d377836dcb","observation_id":"503c8aa7-78ce-41e5-a7a7-b42dcd033de9","resolution":{"observed_at":"2026-08-06T16:40:28.594279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T17:18:54.161687Z","title":"Batchtopk sparse autoencoders.arXiv preprint arXiv:2412.06410,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.16560","last_updated":"2026-07-07T00:22:17Z","snapshot_observed_at":"2026-08-09T16:18:10.268970Z","submitted_at":"2025-08-22T17:26:33Z","title":"Sparse but Wrong: Incorrect L0 Leads to Incorrect Features in Sparse Autoencoders","version":4},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T17:18:54.161687Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2508.16560"},"observation_digest":"sha256:4320e0529e21527a719f1c6ef078e791c9b94ac264426012308ceebcac8f5b6b","observation_id":"c0c8dfd4-f44e-49bd-9257-744ca2bd4923","resolution":{"observed_at":"2026-08-05T17:18:54.161687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2509.05291","last_updated":"2026-04-30T11:00:40Z","snapshot_observed_at":"2026-08-11T07:22:04.590404Z","submitted_at":"2025-09-05T17:56:24Z","title":"Crosscoding Through Time: Tracking Emergence & Consolidation Of Linguistic Representations Throughout LLM Pretraining","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T18:42:33.487450Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2509.05291"},"observation_digest":"sha256:be9437d5f29356af3c2197ccd16f5648ab80d7d92c94d268904c495dc476eaf7","observation_id":"5fd7669a-31c4-4d06-b2ad-a407d597e2cd","resolution":{"observed_at":"2026-05-18T18:42:48.062273Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2509.18127","last_updated":"2026-04-14T10:00:44Z","snapshot_observed_at":"2026-08-02T17:25:00.233548Z","submitted_at":"2025-09-11T11:22:43Z","title":"Safe-SAIL: Towards a Fine-grained Safety Landscape of Large Language Models via Sparse Autoencoder Interpretation Framework","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-18T18:13:01.662828Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2509.18127"},"observation_digest":"sha256:786d509eff749c1c8908f70e5dd9cbf3a23e3f65b91982443a00621b8015bcbe","observation_id":"e8afb824-8d57-4fb8-9b47-d428155bf803","resolution":{"observed_at":"2026-05-18T18:16:43.801278Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-03T12:29:39.483685Z","title":"Bart Bussmann, Noa Nabeshima, Adam Karvonen, and Neel Nanda","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02896","last_updated":"2026-06-26T05:19:31Z","snapshot_observed_at":"2026-08-08T02:39:12.523925Z","submitted_at":"2026-01-06T10:34:14Z","title":"Bridging Mechanistic Interpretability and Prompt Engineering with Gradient Ascent for Interpretable Persona Control","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T12:29:39.483685Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2601.02896"},"observation_digest":"sha256:be03e9719a5d381cd4c618930b6528b81459a1653c78be528a4149d1a07a26db","observation_id":"9cc2795f-dcf3-4d19-9243-b9d719f6a998","resolution":{"observed_at":"2026-08-03T12:29:39.483685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2601.14004","last_updated":"2026-04-14T03:49:06Z","snapshot_observed_at":"2026-08-11T17:12:54.016914Z","submitted_at":"2026-01-20T14:23:23Z","title":"Locate, Steer, and Improve: A Practical Survey of Actionable Mechanistic Interpretability in Large Language Models","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T12:39:57.398423Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2601.14004"},"observation_digest":"sha256:701fa3a4fa2b719a0228a6801e6f99b1673f5d3b65994cde48dad29dc607f576","observation_id":"1fc42ea8-6cec-423a-af82-df4145ac284c","resolution":{"observed_at":"2026-05-16T12:40:54.800252Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-03T04:28:01.342719Z","title":"Bart Bussmann, Patrick Leask, and Neel Nanda","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.05027","last_updated":"2026-02-06T13:35:19Z","snapshot_observed_at":"2026-08-03T12:01:43.618607Z","submitted_at":"2026-02-04T20:29:16Z","title":"AudioSAE: Towards Understanding of Audio-Processing Models with Sparse AutoEncoders","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-03T04:28:01.342719Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2602.05027"},"observation_digest":"sha256:8a92c8fd22420ce09a90c2136c114a4ae9537117c64aefd1a6647d5e164c5749","observation_id":"28967be0-12bc-4b50-a7ef-625d63f809c7","resolution":{"observed_at":"2026-08-03T04:28:01.342719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-03T01:17:12.083084Z","title":"Batchtopk sparse autoencoders.arXiv preprint arXiv:2412.06410, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10388","last_updated":"2026-05-29T05:05:29Z","snapshot_observed_at":"2026-08-07T17:40:15.715656Z","submitted_at":"2026-02-11T00:23:13Z","title":"Less is Enough: Synthesizing Diverse Data in LLM Feature Space with Sparse Autoencoders","version":4},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-03T01:17:12.083084Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2602.10388"},"observation_digest":"sha256:897bf0b8a491d8adf1c128e3bdacc7bf91f5fd92a5e97f0eeac8087bd0f40fcf","observation_id":"b1d248ed-971d-4a35-8ff4-16522c588cc8","resolution":{"observed_at":"2026-08-03T01:17:12.083084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2602.11910","last_updated":"2026-05-18T20:48:30Z","snapshot_observed_at":"2026-07-06T22:45:39.557598Z","submitted_at":"2026-02-12T13:07:14Z","title":"TADA! Tuning Audio Diffusion Models through Activation Steering","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-21T13:40:47.112814Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2602.11910"},"observation_digest":"sha256:83a741399b6b1b62fdf8dc499cfc4fdb53b7fa07a059c8fbe11986bde431f82e","observation_id":"603b3671-5f93-436d-bdbe-f3fd6fcf8561","resolution":{"observed_at":"2026-05-21T13:44:11.562979Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-02T18:56:20.271794Z","title":"Bart Bussmann, Noa Nabeshima, Adam Karvonen, and Neel Nanda","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.04198","last_updated":"2026-06-16T16:00:25Z","snapshot_observed_at":"2026-08-09T04:08:36.721770Z","submitted_at":"2026-03-04T15:46:23Z","title":"Stable and Steerable Sparse Autoencoders with Weight Regularization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T18:56:20.271794Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2603.04198"},"observation_digest":"sha256:bb178ec033faf3cd1f7ed16e1bffeb2038ed48ac6f2710abfc7c7c01d0244929","observation_id":"537afb45-7926-4f65-b41a-afa0b6f65c50","resolution":{"observed_at":"2026-08-02T18:56:20.271794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-07-13T12:01:02.997589Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03919","last_updated":"2026-08-07T18:31:33Z","snapshot_observed_at":"2026-08-12T04:12:16.475463Z","submitted_at":"2026-04-05T01:08:19Z","title":"Interpreting Video Representations with Spatio-Temporal Sparse Autoencoders","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T12:01:02.997589Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2604.03919"},"observation_digest":"sha256:c594290e14a4d78aac4e9b094c8de289401e8848c565200b2714a6003cb9f62d","observation_id":"7b0861a5-8004-419a-84ed-ea0b201911b9","resolution":{"observed_at":"2026-07-13T12:01:02.997589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2604.05724","last_updated":"2026-04-07T11:28:07Z","snapshot_observed_at":"2026-08-02T13:42:34.818815Z","submitted_at":"2026-04-07T11:28:07Z","title":"Beyond Semantics: Disentangling Information Scope in Sparse Autoencoders for CLIP","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T19:11:09.646784Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2604.05724"},"observation_digest":"sha256:57fc640cc1e270cf043468ccb29a5eff5b382a2b57732069fa82bfa077a0c4d3","observation_id":"fa117e4c-b2ec-4bcf-9863-110c761bc669","resolution":{"observed_at":"2026-05-10T23:25:49.640821Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2604.06495","last_updated":"2026-04-07T21:56:23Z","snapshot_observed_at":"2026-08-11T11:51:47.145735Z","submitted_at":"2026-04-07T21:56:23Z","title":"Improving Robustness In Sparse Autoencoders via Masked Regularization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T18:47:15.830063Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2604.06495"},"observation_digest":"sha256:c5d66ae066d831b7f14740347cd9b85fe264b2160fb0d8814de059f5128c2ce9","observation_id":"a3797390-7d0e-48dc-a93e-08c9494bda72","resolution":{"observed_at":"2026-05-10T23:55:51.655631Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2604.08846","last_updated":"2026-04-10T01:01:56Z","snapshot_observed_at":"2026-08-02T14:54:38.934183Z","submitted_at":"2026-04-10T01:01:56Z","title":"Dictionary-Aligned Concept Control for Safeguarding Multimodal LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T18:04:05.157103Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2604.08846"},"observation_digest":"sha256:04f05fb93c8bc7fcac7fdf9f2004267068c4e61de77ba4b868c36458ba6628c7","observation_id":"097fc284-d94b-4e59-ab3f-4aaa43b5715c","resolution":{"observed_at":"2026-05-11T05:35:57.489736Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2605.05341","last_updated":"2026-05-06T18:11:14Z","snapshot_observed_at":"2026-08-11T00:16:32.157589Z","submitted_at":"2026-05-06T18:11:14Z","title":"Feature Starvation as Geometric Instability in Sparse Autoencoders","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T16:31:38.468164Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2605.05341"},"observation_digest":"sha256:bdd6daafe4b1f8dc582aa6b7ab9390b83e4ad5ddd52907f754af428b4a8fe3f4","observation_id":"7d2ffaac-439a-40af-beec-d4d9928df09e","resolution":{"observed_at":"2026-05-08T20:09:09.841748Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2605.06610","last_updated":"2026-05-08T10:28:18Z","snapshot_observed_at":"2026-07-06T23:19:05.764765Z","submitted_at":"2026-05-07T17:28:40Z","title":"SoftSAE: Dynamic Top-K Selection for Adaptive Sparse Autoencoders","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T12:16:18.696425Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2605.06610"},"observation_digest":"sha256:a49a96d46606ec053df356335065cbca0fd0ec15ee08e010ce218ac85d2fc8b7","observation_id":"59fa630e-e600-4236-86aa-8d2d0535f3b5","resolution":{"observed_at":"2026-05-11T19:21:07.232672Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2605.06610","last_updated":"2026-05-08T10:28:18Z","snapshot_observed_at":"2026-07-06T23:19:05.764765Z","submitted_at":"2026-05-07T17:28:40Z","title":"SoftSAE: Dynamic Top-K Selection for Adaptive Sparse Autoencoders","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-11T01:57:20.566117Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2605.06610"},"observation_digest":"sha256:bc48855c378097e33d8069d38903c22159dc0625ccbe4410cd7a39c2373fdb11","observation_id":"877631c1-2697-485d-8d12-5af096b2bf4f","resolution":{"observed_at":"2026-05-11T04:05:57.951965Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2605.07922","last_updated":"2026-05-11T02:18:14Z","snapshot_observed_at":"2026-07-06T23:20:15.696237Z","submitted_at":"2026-05-08T15:57:37Z","title":"Tree SAE: Learning Hierarchical Feature Structures in Sparse Autoencoders","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:58.543525Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2605.07922"},"observation_digest":"sha256:2780393cc913d3cef9a843aa5537abb8f43d504a8c5640a0ab210cc5f5784935","observation_id":"de11537c-5000-4843-9205-21a301603f89","resolution":{"observed_at":"2026-05-11T03:15:54.380486Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2605.07922","last_updated":"2026-05-11T02:18:14Z","snapshot_observed_at":"2026-07-06T23:20:15.696237Z","submitted_at":"2026-05-08T15:57:37Z","title":"Tree SAE: Learning Hierarchical Feature Structures in Sparse Autoencoders","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T03:35:50.776347Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2605.07922"},"observation_digest":"sha256:4dd4b4cbbf851b9339a495b7b119f2ac864fa456b93767e8651dd47d68e18e12","observation_id":"c530d36d-50e6-44ac-8a8b-a7cb94fbba25","resolution":{"observed_at":"2026-05-12T07:16:25.346292Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2605.12122","last_updated":"2026-05-12T13:39:07Z","snapshot_observed_at":"2026-08-10T22:05:43.128711Z","submitted_at":"2026-05-12T13:39:07Z","title":"Disentangled Sparse Representations for Concept-Separated Diffusion Unlearning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T05:49:01.617230Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2605.12122"},"observation_digest":"sha256:4a3b68c3f4970963ed6f373bd545ec8d77be4600b9d8d3b78a638698912f5275","observation_id":"ed783a5b-56aa-48bd-b323-50a08a84152d","resolution":{"observed_at":"2026-05-13T05:52:22.475888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2605.12412","last_updated":"2026-05-12T17:09:41Z","snapshot_observed_at":"2026-08-11T04:19:07.969715Z","submitted_at":"2026-05-12T17:09:41Z","title":"Stories in Space: In-Context Learning Trajectories in Conceptual Belief Space","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-13T05:17:34.283917Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2605.12412"},"observation_digest":"sha256:9246ecd172fe4500c869e4855cfd0138e7d676b8ca93b3ff9c80a594ea144826","observation_id":"f3c49290-2795-4ffc-9e9d-a5f9453e986b","resolution":{"observed_at":"2026-05-13T05:27:19.236436Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-21T07:46:41.159688Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:154ff9a0aedc05158d3f5f15ff4b6e96754466c4e194d222e92fad4ff887637b","observation_id":"d4d1b850-475d-4509-86af-0afd84a77323","resolution":{"observed_at":"2026-05-21T07:49:50.142017Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2605.12809","last_updated":"2026-05-12T23:01:29Z","snapshot_observed_at":"2026-07-06T23:24:27.821980Z","submitted_at":"2026-05-12T23:01:29Z","title":"Correcting Influence: Unboxing LLM Outputs with Orthogonal Latent Spaces","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-14T20:17:01.224864Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2605.12809"},"observation_digest":"sha256:115855e3f63522599c9c6ce7c5e7b23b394633ccb53349aec8ad7dfdda5e22cf","observation_id":"108a6900-bb62-44d4-b840-11496ecff9fd","resolution":{"observed_at":"2026-05-14T20:19:27.635167Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2605.14694","last_updated":"2026-05-14T11:10:52Z","snapshot_observed_at":"2026-08-07T16:34:09.292629Z","submitted_at":"2026-05-14T11:10:52Z","title":"The Rate-Distortion-Polysemanticity Tradeoff in SAEs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T21:13:01.880935Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2605.14694"},"observation_digest":"sha256:9ddfd41b291759cd3d569f63fda1ee390c11cb70ffc11b689bf70e190d748cac","observation_id":"23a43007-35a2-4df1-9e38-8e4c054799f8","resolution":{"observed_at":"2026-06-30T21:15:04.060710Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2605.18229","last_updated":"2026-05-18T11:20:57Z","snapshot_observed_at":"2026-08-09T07:08:46.312980Z","submitted_at":"2026-05-18T11:20:57Z","title":"Are Sparse Autoencoder Benchmarks Reliable?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T12:43:13.014365Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2605.18229"},"observation_digest":"sha256:b1d23f4c125fcacfe817b710ef41eccb6461496a86f1b3e4d3a60f0ec20523a0","observation_id":"0ba08d8c-35a6-43b4-a04b-4da18e2f3f83","resolution":{"observed_at":"2026-05-20T12:43:16.754916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2605.22679","last_updated":"2026-05-21T16:23:34Z","snapshot_observed_at":"2026-07-06T23:32:59.663926Z","submitted_at":"2026-05-21T16:23:34Z","title":"Conceptualizing Embeddings: Sparse Disentanglement for Vision-Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:50.415408Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2605.22679"},"observation_digest":"sha256:b2f41f193c28060cbc4df2d4fb5370b2521b556ec74f323fcf7cc99946b15884","observation_id":"6e93ea94-3dfd-4b80-b8c7-06e43ad3527a","resolution":{"observed_at":"2026-05-22T05:51:07.669442Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2605.28149","last_updated":"2026-08-04T06:19:42Z","snapshot_observed_at":"2026-08-07T23:09:28.260788Z","submitted_at":"2026-05-27T08:31:43Z","title":"Sign-Aware Gated Sparse Autoencoders: Modeling Anticorrelated Features with Bi-Jump-ReLU Activations","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-29T14:16:44.232080Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2605.28149"},"observation_digest":"sha256:b581f3c4c36fe4a7dfa1b8d027b29068bde23851b6f8aa1816998896902d6362","observation_id":"61f6bdb6-149c-4e0a-9f83-222c5d7d2844","resolution":{"observed_at":"2026-06-29T14:23:30.802589Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-04T05:02:51.377381Z","title":"BatchTopK sparse autoencoders.arXiv preprint arXiv:2412.06410, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.28149","last_updated":"2026-08-04T06:19:42Z","snapshot_observed_at":"2026-08-07T23:09:28.260788Z","submitted_at":"2026-05-27T08:31:43Z","title":"Sign-Aware Gated Sparse Autoencoders: Modeling Anticorrelated Features with Bi-Jump-ReLU Activations","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T05:02:51.377381Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2605.28149"},"observation_digest":"sha256:9fa32f8c75deb0435bb5e5d1eca4064783a6b1c242d2a8f957f342c4c9b8d5c5","observation_id":"ef22c454-23fc-4cc3-ba90-f37c5c0ad00d","resolution":{"observed_at":"2026-08-04T05:02:51.377381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2606.06333","last_updated":"2026-06-04T16:08:25Z","snapshot_observed_at":"2026-08-02T07:30:20.394633Z","submitted_at":"2026-06-04T16:08:25Z","title":"Subspace-Aware Sparse Autoencoders for Effective Mechanistic Interpretability","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-28T02:07:18.198225Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2606.06333"},"observation_digest":"sha256:763e961ad2e46695aa1c51295fd1ce27e3e5a6bfe8a2bae7951ebc94c9a6f883","observation_id":"6449e448-95e8-499b-8287-c4fe0d9d90c7","resolution":{"observed_at":"2026-06-28T02:11:29.033059Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2606.07963","last_updated":"2026-06-06T03:41:44Z","snapshot_observed_at":"2026-08-03T02:43:15.954284Z","submitted_at":"2026-06-06T03:41:44Z","title":"Shared Latent Structures Enable Unified Backdoor Detection and Mitigation in LLMs","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-06-27T20:05:30.325338Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2606.07963"},"observation_digest":"sha256:a472a68058744f4f199905d897cdc7276387f98bc027c64febc6ca22fb2e5073","observation_id":"0ed3798e-d46f-4b5e-9e96-fc47fe6d009a","resolution":{"observed_at":"2026-07-02T20:47:23.493938Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2606.09940","last_updated":"2026-06-08T00:15:44Z","snapshot_observed_at":"2026-07-06T23:49:12.754871Z","submitted_at":"2026-06-08T00:15:44Z","title":"Interactions Between Crosscoder Features: A Compact Proofs Perspective","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-27T17:25:55.152823Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2606.09940"},"observation_digest":"sha256:54f3bab65b7e96df8e57d4f1a935ef3d97537e6ed56c25ed0b0b86eec7c6ab77","observation_id":"c901cc09-7be8-4da6-b28d-559f6e3a1565","resolution":{"observed_at":"2026-07-03T00:07:28.611651Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2606.10080","last_updated":"2026-06-08T18:54:31Z","snapshot_observed_at":"2026-07-06T23:49:17.868841Z","submitted_at":"2026-06-08T18:54:31Z","title":"VFUSE: Virulent Feature Understanding with Sparse autoEncoders","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-27T16:57:52.441415Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2606.10080"},"observation_digest":"sha256:43d7f5322036a33542d3637eb81283fb273fc3c569c9909a6eb90b7dea821b2e","observation_id":"222566cb-6b5a-4cd2-b84d-73c0dc35c862","resolution":{"observed_at":"2026-07-03T00:57:29.988003Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2606.11722","last_updated":"2026-06-10T06:53:58Z","snapshot_observed_at":"2026-08-02T23:00:11.313609Z","submitted_at":"2026-06-10T06:53:58Z","title":"ICA Lens: Interpreting Language Models Without Training Another Dictionary","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T10:21:58.878499Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2606.11722"},"observation_digest":"sha256:9fe2317c5b32a53f1dd43e0cebecde38305a0d92a730c1d26526256a518a1f20","observation_id":"df4ce66e-ab01-4048-8b9a-a7c9b2b922ea","resolution":{"observed_at":"2026-07-03T09:17:49.080404Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2606.14990","last_updated":"2026-06-16T02:02:24Z","snapshot_observed_at":"2026-08-10T00:03:17.939494Z","submitted_at":"2026-06-12T22:22:40Z","title":"Rational Sparse Autoencoder","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T04:29:27.383661Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2606.14990"},"observation_digest":"sha256:0ac59f7710a29a734424dd3d411a5e539d5d86066e14c2795fb387876fbd8ba1","observation_id":"01d14aaa-1391-40d7-bd82-11da55db7ebf","resolution":{"observed_at":"2026-07-03T17:08:43.972416Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2606.15054","last_updated":"2026-06-29T22:04:02Z","snapshot_observed_at":"2026-08-03T01:16:15.417885Z","submitted_at":"2026-06-13T01:51:05Z","title":"Size Doesn't Matter: Cosine-Scored Sparse Autoencoders","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-01T07:15:16.674714Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2606.15054"},"observation_digest":"sha256:5583ff425d735d4a114d49237e7f38967e0dccb19b93d9e0c236dbba85c14ec9","observation_id":"0468e501-4c22-4174-8d38-d6d427b94900","resolution":{"observed_at":"2026-07-01T07:15:29.601747Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2606.25657","last_updated":"2026-06-24T10:11:04Z","snapshot_observed_at":"2026-08-10T18:37:42.196432Z","submitted_at":"2026-06-24T10:11:04Z","title":"Steering Vision-Language Models with Joint Sparse Autoencoders","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-06-25T20:56:57.716246Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2606.25657"},"observation_digest":"sha256:582cde6bc5dfb7e51071764d2b0f5755b97fb67967a1bc3cc30be17bf5ed976d","observation_id":"739db077-04f0-4f77-b2aa-a4ec6142f7de","resolution":{"observed_at":"2026-07-04T20:00:07.782403Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2606.27321","last_updated":"2026-07-14T14:49:19Z","snapshot_observed_at":"2026-08-01T21:46:17.605652Z","submitted_at":"2026-06-25T17:34:39Z","title":"Beyond the Hard Budget: Sparsity Regularizers for More Interpretable Top-k Sparse Autoencoders","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T05:01:55.327724Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2606.27321"},"observation_digest":"sha256:9569067f4ce46c6d7ba931db6c337f965848e939661bfbab81931aa32a83a163","observation_id":"cf3d30fe-c7c9-4c71-a1cd-49e98b5d21bd","resolution":{"observed_at":"2026-07-04T13:39:50.942239Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-07-15T10:30:51.183063Z","title":"arXiv:2412.06410","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.27321","last_updated":"2026-07-14T14:49:19Z","snapshot_observed_at":"2026-08-01T21:46:17.605652Z","submitted_at":"2026-06-25T17:34:39Z","title":"Beyond the Hard Budget: Sparsity Regularizers for More Interpretable Top-k Sparse Autoencoders","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-15T10:30:51.183063Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2606.27321"},"observation_digest":"sha256:48fcc68b6b1c5920b1f8e743aea3d0e81e4827645d8891ec6e84e9af18abffee","observation_id":"b09827db-6e2b-467b-9e60-f751b4981ac0","resolution":{"observed_at":"2026-07-15T10:30:51.183063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2606.27440","last_updated":"2026-06-25T18:01:44Z","snapshot_observed_at":"2026-08-08T15:26:46.154537Z","submitted_at":"2026-06-25T18:01:44Z","title":"PairSAE: Mechanistic Interpretability from Pair Representations in Protein Co-Folding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T01:24:01.833060Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2606.27440"},"observation_digest":"sha256:f2c81bd1ae80705c22bb5d60b2e472ae2a11d0ff293a26fcc4d27aebee1e896b","observation_id":"9c7c01ee-02fc-4d9c-9d0a-6c05bca2772e","resolution":{"observed_at":"2026-07-01T18:55:58.716507Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2606.28548","last_updated":"2026-06-26T19:07:34Z","snapshot_observed_at":"2026-07-07T00:02:38.226622Z","submitted_at":"2026-06-26T19:07:34Z","title":"Turn-Averaged SAEs for Feature Discovery and Long-Context Attribution","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T01:20:29.026464Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2606.28548"},"observation_digest":"sha256:484cf82c872088b1a2973658edafaed36e3131462ca4cb4e910287134ffcbba5","observation_id":"0cde1526-4207-402d-89d0-455ba25784b0","resolution":{"observed_at":"2026-07-01T15:35:48.381247Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2607.00023","last_updated":"2026-06-19T02:39:50Z","snapshot_observed_at":"2026-07-07T00:05:41.920778Z","submitted_at":"2026-06-19T02:39:50Z","title":"Aligning Sentence Embeddings to Human Concepts via Sparse Autoencoders","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-02T22:19:00.111304Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2607.00023"},"observation_digest":"sha256:d8020161cf7f830bbc7f6794446f7844cd2040c141d893866c83b2df23a5d786","observation_id":"c88c33bf-2ec4-4373-ac07-2f836ac05e81","resolution":{"observed_at":"2026-07-02T22:27:25.257762Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2607.01799","last_updated":"2026-07-02T07:16:14Z","snapshot_observed_at":"2026-08-01T04:03:30.581540Z","submitted_at":"2026-07-02T07:16:14Z","title":"Expander Sparse Autoencoders: Parameter-Efficient Dictionaries for Mechanistic Interpretability","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-03T17:19:36.936483Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2607.01799"},"observation_digest":"sha256:119da4e88c2dc6da9ac5a37da3d6f208dcd934328e8b787518ea01ee725be8a1","observation_id":"dfae3e4d-9e89-46db-8e1d-9ad165096570","resolution":{"observed_at":"2026-07-03T17:28:44.142380Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2412.06410","doi":"10.48550/arxiv.2412.06410","metadata_source":"pith","pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batchtopk sparse autoencoders","venue":"cs.LG","work_id":"812bea0e-6edc-46bc-8213-fbf0ebf4b662","year":2024},"citing_paper":{"arxiv_id":"2607.07316","last_updated":"2026-07-08T12:04:38Z","snapshot_observed_at":"2026-08-07T03:56:05.019257Z","submitted_at":"2026-07-08T12:04:38Z","title":"Mechanistic Interpretability for Neural Networks: Circuits, Sparse Features and Symbolic Reasoning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-09T14:58:58.363330Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2607.07316"},"observation_digest":"sha256:70affd9767b2a7a1f1f3b2715ce935b75ff3857d7554072cb8dd6024078983a5","observation_id":"e8fddea9-8b35-4737-a383-eada0b901c16","resolution":{"observed_at":"2026-07-09T15:06:18.048729Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-01T18:04:16.903014Z","title":"2412.06410 , archiveprefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17425","last_updated":"2026-07-21T01:20:50Z","snapshot_observed_at":"2026-08-09T20:58:05.060704Z","submitted_at":"2026-07-19T22:19:17Z","title":"Decoder-Preserving Sparse Autoencoders: Which Readouts Survive Sparse Compression?","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T18:04:16.903014Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2607.17425"},"observation_digest":"sha256:b143d625a0a5ec1ed053e38c7cf33bb8f642b49df2a9f0541ab46aee044f42d6","observation_id":"7a9befc9-8f4f-40a6-bb2b-b6340ac3188a","resolution":{"observed_at":"2026-08-01T18:04:16.903014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-02T12:35:15.929259Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22570","last_updated":"2026-06-01T17:20:16Z","snapshot_observed_at":"2026-08-05T20:13:19.493396Z","submitted_at":"2026-06-01T17:20:16Z","title":"Reference Feature Atlases for Mechanistic Auditing of Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-02T12:35:15.929259Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2607.22570"},"observation_digest":"sha256:2bf09ee21e91ef6bdd03d1023eaa13aa51c09e9af685faaa741e5e011e53bfc9","observation_id":"7853accc-125a-42e7-93b1-aee7d6f57a53","resolution":{"observed_at":"2026-08-02T12:35:15.929259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-07-31T13:41:41.992934Z","title":"Bart Bussmann, Noa Nabeshima, Adam Karvonen, and Neel Nanda","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24484","last_updated":"2026-07-27T14:20:59Z","snapshot_observed_at":"2026-08-10T17:39:42.014977Z","submitted_at":"2026-07-27T14:20:59Z","title":"What do Reward Models Memorize?","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-07-31T13:41:41.992934Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2607.24484"},"observation_digest":"sha256:36e93ecc741f6eb549751f49de0bf7010ff9712b018e2b3ddd458bd28fe40b5d","observation_id":"0fa6ef38-b4d4-4936-937a-80e179737dcc","resolution":{"observed_at":"2026-07-31T13:41:41.992934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-07-31T07:22:46.247845Z","title":"Carion, N.; Gustafson, L.; Hu, Y.-T.; Debnath, S.; Hu, R.; Suris, D.; Ryali, C.; Alwala, K","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24706","last_updated":"2026-07-29T04:55:47Z","snapshot_observed_at":"2026-08-09T08:49:12.665163Z","submitted_at":"2026-07-27T17:46:18Z","title":"SADe: Sparse-Atom Support Decontamination for Few-Shot Segmentation with Weak Support Annotations","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-07-31T07:22:46.247845Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2607.24706"},"observation_digest":"sha256:ccde99386b49f8e49f3a8894d0ccb1eeabed60941a110f80eaec5f1b61b12626","observation_id":"012d2172-bdb6-4587-8fed-ec8e3799926b","resolution":{"observed_at":"2026-07-31T07:22:46.247845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-01T03:03:55.931973Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25244","last_updated":"2026-07-28T03:38:03Z","snapshot_observed_at":"2026-08-07T10:52:16.899617Z","submitted_at":"2026-07-28T03:38:03Z","title":"CADENCE: A Cardiac Atom Dictionary for Interpretable Neural Concept Extraction from ECG Foundation Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T03:03:55.931973Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2607.25244"},"observation_digest":"sha256:22d80ec5993b19aae3f28eafc195f787c58e72cf9c918261c85522b80390cf94","observation_id":"51a16269-d6af-4b2c-9132-f79570b8270a","resolution":{"observed_at":"2026-08-01T03:03:55.931973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-01T07:58:31.293823Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27404","last_updated":"2026-07-29T19:20:50Z","snapshot_observed_at":"2026-08-07T16:37:14.209504Z","submitted_at":"2026-07-29T19:20:50Z","title":"ECG-InterpBench: Benchmarking the Interpretability of ECG Foundation Models with Matched-Scale Sparse Autoencoders","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T07:58:31.293823Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2607.27404"},"observation_digest":"sha256:1b2a0447bc3187bcf464607d71b07dcd2d728a5c59db83440affa20fbabedb4e","observation_id":"eba49413-a09c-4e1e-8e5d-666a80fa22d8","resolution":{"observed_at":"2026-08-01T07:58:31.293823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-05T17:48:45.349661Z","title":"NeurIPS 2024 Workshop on Scientific Methods for Understanding Deep Learning , year =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03507","last_updated":"2026-08-04T11:49:16Z","snapshot_observed_at":"2026-08-10T21:22:13.209084Z","submitted_at":"2026-08-04T11:49:16Z","title":"ChronoLens: Measuring Language Change Across Time, Languages, and Linguistic Levels","version":1},"reference_index":108,"source":"arxiv_source","source_observed_at":"2026-08-05T17:48:45.349661Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2608.03507"},"observation_digest":"sha256:7bc12d7f112be733e452958e03e8cd0a798614718734e2f78a0570000c210ab0","observation_id":"ad5ff4d9-0c41-4812-97b7-475eb3a0a008","resolution":{"observed_at":"2026-08-05T17:48:45.349661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-08T00:53:24.728224Z","title":"arXiv preprint arXiv:2412.06410 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04057","last_updated":"2026-08-04T12:17:00Z","snapshot_observed_at":"2026-08-11T00:21:41.715620Z","submitted_at":"2026-08-04T12:17:00Z","title":"LaPrune: Controllable Differentiable Sparsity at Million Scale","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-08T00:53:24.728224Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2608.04057"},"observation_digest":"sha256:d1af477c34374e27b58ae4fa75ff8bc84c361f45d14636a126b91aaa67b1bf46","observation_id":"5549e875-12c1-45ef-adf9-733c6506def8","resolution":{"observed_at":"2026-08-08T00:53:24.728224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.06410/citation-record","integrity":"/paper/2412.06410/integrity","json":"/paper/2412.06410/citation-record.json","paper":"/paper/2412.06410"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:45:03.947451Z","title":"Towards monosemanticity: Decomposing language models with dictionary learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T19:45:03.947451Z"},"links":{"citing_paper":"/paper/2412.06410"},"observation_digest":"sha256:2af416b9b78aeea9b0df9a1acfe922cf719f5ee3a4c78909cf66eed62c2c199e","observation_id":"3b238dec-854c-4485-a474-e4136a9ba6fa","resolution":{"observed_at":"2026-08-11T19:45:03.947451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-11T07:21:14.568175Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-11T19:45:03.958107Z","title":"Sparse autoen- coders find highly interpretable features in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T19:45:03.958107Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2412.06410"},"observation_digest":"sha256:9feeb0c5dcfde40dff15b528f7d9fceb1098374c6f8d0ea6ea3f70b423395af0","observation_id":"7f31a77e-0d43-4fe3-867f-56c88ebb3e3a","resolution":{"observed_at":"2026-08-11T19:45:03.958107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:45:04.273392Z","title":"Scaling and evaluating sparse autoencoders, 2024","venue":null,"work_id":"650a2515-bf6c-4903-9f6b-bbe2085f3ea7","year":2024},"citing_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T19:45:03.970346Z"},"links":{"citing_paper":"/paper/2412.06410"},"observation_digest":"sha256:c4eb274e7508a1195cd2fa9f891ec0f01ec716cc2cc03467c91dc53ca78ea5d2","observation_id":"48137e04-f626-4d30-948d-5115a4e9f783","resolution":{"observed_at":"2026-08-11T19:45:04.286067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:45:03.978414Z","title":"k-sparse autoencoders, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T19:45:03.978414Z"},"links":{"citing_paper":"/paper/2412.06410"},"observation_digest":"sha256:bb11aa9ddf4ec12fa3ffa7511009bd629b232fc61cc9a29cc4c9dab7414615c7","observation_id":"b5adc8a3-6bbc-4a5e-bd83-5d4f3337615a","resolution":{"observed_at":"2026-08-11T19:45:03.978414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:45:03.984496Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T19:45:03.984496Z"},"links":{"citing_paper":"/paper/2412.06410"},"observation_digest":"sha256:ed72c489ddc4860501c8bcfe216ee03b88e8a84f3053842500a3d19e46a1f4f2","observation_id":"a260f4a0-f4ab-41e0-9040-ce0f2a8a9112","resolution":{"observed_at":"2026-08-11T19:45:03.984496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:45:04.201730Z","title":"Improving dictionary learning with gated sparse autoen- coders, 2024","venue":null,"work_id":"03e7f080-8d4f-4324-b231-e4c9959cd7ce","year":2024},"citing_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T19:45:03.994114Z"},"links":{"citing_paper":"/paper/2412.06410"},"observation_digest":"sha256:32ed5b3b7b27e676ed80167b6246933e92ae1daf84c48ce7337655928090992a","observation_id":"66c55cb5-af1c-49b0-b219-6cdf7ef340bf","resolution":{"observed_at":"2026-08-11T19:45:04.209799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:45:04.038150Z","title":"Jumping ahead: Improving reconstruction fidelity with jumprelu sparse autoencoders, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T19:45:04.038150Z"},"links":{"citing_paper":"/paper/2412.06410"},"observation_digest":"sha256:a2ac6147fca231368e47ae750e26a7b4bdcb057f8c14e7b21d08184b4598d9ee","observation_id":"1a65aefc-3336-46dc-8b92-b322401ed1ab","resolution":{"observed_at":"2026-08-11T19:45:04.038150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-11T19:45:04.043163Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T19:45:04.043163Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.06410"},"observation_digest":"sha256:07361b40d9d8e220df3b0a04b13d8065803f8f9646d6687f5dc5721aadb269e5","observation_id":"e36857fa-a872-4bce-a00b-93059727af4b","resolution":{"observed_at":"2026-08-11T19:45:04.043163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:45:04.162412Z","title":"Scaling monosemanticity: Extracting interpretable features from claude 3 sonnet","venue":null,"work_id":"4057bb0b-33ce-43df-b04e-a953f7f2f7e4","year":2024},"citing_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T19:45:04.047934Z"},"links":{"citing_paper":"/paper/2412.06410"},"observation_digest":"sha256:071a0d53e03b722a98793d5fc3fee6c62ae67fb651a211f41204ebc108864d80","observation_id":"06f6def2-792f-45d6-80fb-598c91105c7b","resolution":{"observed_at":"2026-08-11T19:45:04.171898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders"},"reference_resolution":{"displayed":9,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":9},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 9 of 9 outbound references and 64 inbound Pith citation observations for arXiv:2412.06410."}