{"as_of":"2026-08-09T15:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c436b45e1084cd539bc3de30e8ee4307f5fea91af4f5c80032bab2d54d080b88","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T13:23:22.708604Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.10226/citation-record","integrity":"/paper/2607.10226/integrity","json":"/paper/2607.10226/citation-record.json","paper":"/paper/2607.10226"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.11717","last_updated":"2024-10-30T18:57:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-17T16:36:12Z","title":"Refusal in Language Models Is Mediated by a Single Direction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11717","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Trenton Bricken, Adly Templeton, Joshua Batson, Brian Chen, Adam Jermyn, Tom Conerly, Nicholas L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-02T08:49:17.463451Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2406.11717","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:3c6fb8a35a8a706021656333118db64e3b516f81e95b2deba4659577109fea3b","observation_id":"cf4ded39-27c8-4b13-ac80-12b0a360004d","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Hoagy Cunningham, Aidan Ewart, Logan Riggs, Robert Huben, and Lee Sharkey","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-02T08:49:17.463451Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:e61bd572dce33c13a5d75e2fd6d114cd32015c5b3132b04f2bc858f64c4e5896","observation_id":"8ec33f83-6c48-449f-8bf7-0c651fe993d9","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-07-06T16:19:05.495349Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Abhimanyu Dubey, Abhinav Jauhri, Abhinav Pandey, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-02T08:49:17.463451Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:7a336f46ed5e609ad7db85e082c64bc2dcdf37b1c537fd2ddd180d048a7d95e2","observation_id":"97537d91-5005-47c6-9585-ee8f53865476","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-02T08:49:17.463451Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:d2543dad9cea4a002833b52ff15881d6f53cae6bd8468abc007e430b2a6f6e3a","observation_id":"538b963b-2a7d-41fe-ac9e-80a08fa3bca6","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17713","last_updated":"2024-11-18T21:42:17Z","snapshot_observed_at":"2026-08-09T03:38:09.634763Z","submitted_at":"2024-11-18T21:42:17Z","title":"Llama Guard 3-1B-INT4: Compact and Efficient Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17713","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Gemma Team","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-02T08:49:17.463451Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2411.17713","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:53734a05e23b72becdf96e83b2ed9aac5c59ed754b87822997d27e27d92e2298","observation_id":"794b1101-7735-42a0-a3d8-a53e13c7148a","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Zhengfu He, Wentao Shu, Xuyang Ge, Lingjie Chen, Junxuan Wang, Yunhua Zhou, Frances Liu, Qipeng Guo, Xuanjing Huang, Zuxuan Wu, Yu-Gang Jiang, and Xipeng Qiu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-02T08:49:17.463451Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:0d4137897b82838f83ba476f8436cac81965334394bff0d248b8300fdd047422","observation_id":"9854b652-f25d-4651-8f55-1cc62a74f677","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Dan Hendrycks, Collin Burns, Steven Basart, Andy Zou, Mantas Mazeika, Dawn Song, and Jacob Steinhardt","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-02T08:49:17.463451Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:488f87db92ed54913a6ef3e5469ef8a7e7aeda6c99016e8a0103d3a7f8d2a08a","observation_id":"60b03b10-a014-49a2-907e-824206c2bffa","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-09T10:28:06.906299Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Liwei Jiang, Kavel Rao, Seungju Han, Allyson Ettinger, Faeze Brahman, Sachin Kumar, Niloofar Mireshghallah, Ximing Lu, Maarten Sap, Yejin Choi, and Nouha Dziri","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-02T08:49:17.463451Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:186147cac4e0947ed144a4651cb03274a4162ebe12de404f4f4b09c56bed94d8","observation_id":"bd962976-c7e0-4b71-9f83-010c868e279c","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18510","last_updated":"2024-06-26T17:31:22Z","snapshot_observed_at":"2026-08-07T07:51:30.753226Z","submitted_at":"2024-06-26T17:31:22Z","title":"WildTeaming at Scale: From In-the-Wild Jailbreaks to (Adversarially) Safer Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18510","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Tom Lieberum, Senthooran Rajamanoharan, Arthur Conmy, Lewis Smith, Nicolas Sonnerat, Vikrant Varma, Janos Kramar, Anca Dragan, Rohin Shah, and Neel Nanda","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-02T08:49:17.463451Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2406.18510","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:d241921d400e532b2f812b25d6c2a3e8f90d75124889a2f0d50c821d42674457","observation_id":"2e1d3879-bf63-4e4d-b305-87c584e031db","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05147","last_updated":"2024-08-19T07:51:05Z","snapshot_observed_at":"2026-08-04T11:44:14.524984Z","submitted_at":"2024-08-09T16:06:42Z","title":"Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05147","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"21 Mantas Mazeika, Long Phan, Xuwang Yin, Andy Zou, Zifan Wang, Norman Mu, Elham Sakhaee, Nathaniel Li, Steven Basart, Bo Li, David Forsyth, and Dan Hendrycks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-02T08:49:17.463451Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2408.05147","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:3637da5aad29a7461eb1f34e8dd75d2f66af76cde0c9046ee41de976c68ee4ce","observation_id":"81b2608a-47c8-4ec4-9b14-1a2c108bec51","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Paul Rottger, Hannah Rose Kirk, Bertie Vidgen, Giuseppe Attanasio, Federico Bianchi, and Dirk Hovy","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-02T08:49:17.463451Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:87822ea61c85651e131a73fbf990bef9e99aa121ab19c426fc6f198bfb64ba57","observation_id":"f57db782-a748-44c2-89dc-ecb498631e99","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01263","last_updated":"2024-04-01T11:50:35Z","snapshot_observed_at":"2026-08-03T00:58:55.865010Z","submitted_at":"2023-08-02T16:30:40Z","title":"XSTest: A Test Suite for Identifying Exaggerated Safety Behaviours in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01263","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Alexander Matt Turner, Lisa Thiergart, Gavin Leech, David Udell, Juan J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-02T08:49:17.463451Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2308.01263","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:fd4f3f965f4cec0e53a4b9df44379fe378ca2d0d2efb55f42f2ebe42b03e497d","observation_id":"cecc21b7-45be-4dc0-8944-977367f56a2b","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Andy Zou, Long Phan, Sarah Chen, James Campbell, Phillip Guo, Richard Ren, Alexander Pan, Xuwang Yin, Mantas Mazeika, Ann-Kathrin Dombrowski, Shashwat Goel, Nathaniel Li, Michael J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-02T08:49:17.463451Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:635726b9a6866cd05a306766bfb697931f9120f0c904a88080a760bc99572135","observation_id":"69d632b0-843a-4e42-adc5-1abec4b73da1","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-02T08:49:17.463451Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:d4f15918a98ea26c181beab1162ae496f8a543ad40d8a25da8c6ec725a0d57a1","observation_id":"dba96bb6-5e97-4caf-91c9-d146da754562","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-02T08:49:17.463451Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2607.10226."}