{"as_of":"2026-08-11T13:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:17186c9f11036cf0e6d9a53ae3db4a72d5ebd2dd2641213a28c2e864e7b5b186","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":26,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:17:55.782849Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-10T19:34:26.909588Z","title":"David Chanin, James Wilken-Smith, Tomáš Dulka, Hardik Bhatnagar, and Joseph Bloom","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09929","last_updated":"2025-04-02T13:20:40Z","snapshot_observed_at":"2026-08-10T19:28:48.617503Z","submitted_at":"2025-01-17T02:55:23Z","title":"Interpretable Steering of Large Language Models with Feature Guided Activation Additions","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:26.909588Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2501.09929"},"observation_digest":"sha256:00481d45b5f3cddd7e94fd7a5f76d4b26aafdc56063a556c3a67a611e80a48af","observation_id":"d87ac576-f7f9-4db6-9b55-bd6313842b14","resolution":{"observed_at":"2026-08-10T19:34:26.909588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-09T10:11:51.456407Z","title":"Improving steering vectors by targeting sparse autoencoder features, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03032","last_updated":"2025-07-24T21:16:27Z","snapshot_observed_at":"2026-08-10T02:30:42.809107Z","submitted_at":"2025-02-05T09:39:34Z","title":"Analyze Feature Flow to Enhance Interpretation and Steering in Language Models","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T10:11:51.456407Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2502.03032"},"observation_digest":"sha256:a92c6a59428054c1f7d6a543eb982e249bf1ad7ad17444a9ef7969722e032a48","observation_id":"8e0726db-180b-438b-a167-df0d0d9fc048","resolution":{"observed_at":"2026-08-09T10:11:51.456407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-07T15:01:47.266440Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16612","last_updated":"2025-10-14T08:28:41Z","snapshot_observed_at":"2026-08-08T06:16:44.202411Z","submitted_at":"2025-05-22T12:47:16Z","title":"Steering Large Language Models for Machine Translation Personalization","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:01:47.266440Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2505.16612"},"observation_digest":"sha256:d06a5c0864fdb0e43bd286989f87a0038e16b795f6181dd3c9745d29f0a12c9f","observation_id":"3159d892-b602-495b-89bc-6bd7b45f991a","resolution":{"observed_at":"2026-08-07T15:01:47.266440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-07T14:02:59.154435Z","title":"Improving steering vectors by targeting sparse autoencoder features.arXiv preprint arXiv:2411.02193, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20254","last_updated":"2025-05-26T17:31:36Z","snapshot_observed_at":"2026-08-10T22:41:34.301829Z","submitted_at":"2025-05-26T17:31:36Z","title":"Position: Mechanistic Interpretability Should Prioritize Feature Consistency in SAEs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:02:59.154435Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2505.20254"},"observation_digest":"sha256:777cf16387de1fa6b5f46930d9867fcdbcf92d50ff39700cd5d446389b124b02","observation_id":"d04aa17b-e3fd-4de2-a6cf-85e93322aba3","resolution":{"observed_at":"2026-08-07T14:02:59.154435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-07T14:38:52.048185Z","title":"David Chanin, James Wilken-Smith, Tomás Dulka, Hardik Bhatnagar, and Joseph Bloom","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20322","last_updated":"2025-06-03T13:40:17Z","snapshot_observed_at":"2026-08-09T18:09:15.077695Z","submitted_at":"2025-05-23T17:59:18Z","title":"Beyond Prompt Engineering: Robust Behavior Control in LLMs via Steering Target Atoms","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T14:38:52.048185Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2505.20322"},"observation_digest":"sha256:a4e1e2084f47ff8943462ecb25639d9ef1a8a9e6ca27efb406a7fb55a89c4b5c","observation_id":"3d775816-7bcf-4e05-8ed6-7fdbe7c05813","resolution":{"observed_at":"2026-08-07T14:38:52.048185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-07T12:30:03.859840Z","title":"Im- proving Steering Vectors by Targeting Sparse Autoencoder Features, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24360","last_updated":"2025-07-10T23:59:56Z","snapshot_observed_at":"2026-08-09T07:02:16.860236Z","submitted_at":"2025-05-30T08:53:27Z","title":"Interpreting Large Text-to-Image Diffusion Models with Dictionary Learning","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:03.859840Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2505.24360"},"observation_digest":"sha256:9c537b0da5118b803a5bb79548b5ee56fc9cc484d4a6bfb98d67dd1a0b18e658","observation_id":"b2788b2d-648a-43fe-ad66-258085818b62","resolution":{"observed_at":"2026-08-07T12:30:03.859840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":"2411.02193","doi":"10.48550/arxiv.2411.02193","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving steering vectors by targeting sparse autoencoder features.arXiv preprint arXiv:2411.02193","venue":"arXiv (Cornell University)","work_id":"a13a989e-ea2e-4d17-b6be-0378be042e41","year":2023},"citing_paper":{"arxiv_id":"2506.01770","last_updated":"2026-04-18T05:40:12Z","snapshot_observed_at":"2026-08-04T01:20:56.393646Z","submitted_at":"2025-06-02T15:17:38Z","title":"ReGA: Model-Based Safeguard for LLMs via Representation-Guided Abstraction","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-19T11:34:09.428653Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2506.01770"},"observation_digest":"sha256:bca5dcf8813026d4415d6d5520ffe6caed8c9bbcd0a4b85c407f3d43a9980626","observation_id":"249a05ac-306b-4253-be12-a13783ea0df7","resolution":{"observed_at":"2026-05-19T11:37:16.005446Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-07T10:24:26.327706Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05451","last_updated":"2025-06-05T17:56:05Z","snapshot_observed_at":"2026-08-09T11:07:48.259327Z","submitted_at":"2025-06-05T17:56:05Z","title":"Interpretation Meets Safety: A Survey on Interpretation Methods and Tools for Improving LLM Safety","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:24:26.327706Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2506.05451"},"observation_digest":"sha256:701ca480d7442e5a57e7080395fd7e8bab1885949e48c5dbf8c7bd50600027e1","observation_id":"d8ea653f-a2ff-40a9-9f0f-2877412ba779","resolution":{"observed_at":"2026-08-07T10:24:26.327706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":"2411.02193","doi":"10.48550/arxiv.2411.02193","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving steering vectors by targeting sparse autoencoder features.arXiv preprint arXiv:2411.02193","venue":"arXiv (Cornell University)","work_id":"a13a989e-ea2e-4d17-b6be-0378be042e41","year":2023},"citing_paper":{"arxiv_id":"2602.02280","last_updated":"2026-05-12T03:47:11Z","snapshot_observed_at":"2026-08-11T07:06:38.718933Z","submitted_at":"2026-02-02T16:20:51Z","title":"RACC: Representation-Aware Coverage Criteria for LLM Safety Testing","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T08:12:55.296932Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2602.02280"},"observation_digest":"sha256:c2d5b5966ab55c9f91d1b8bb00a2b4196375377fefcdd9b91ef5aab749047801","observation_id":"5ecc1534-6c9f-49e4-81b8-68ce454375a6","resolution":{"observed_at":"2026-05-16T08:17:36.642532Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":"2411.02193","doi":"10.48550/arxiv.2411.02193","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving steering vectors by targeting sparse autoencoder features.arXiv preprint arXiv:2411.02193","venue":"arXiv (Cornell University)","work_id":"a13a989e-ea2e-4d17-b6be-0378be042e41","year":2023},"citing_paper":{"arxiv_id":"2605.01844","last_updated":"2026-06-04T12:53:36Z","snapshot_observed_at":"2026-07-06T23:15:01.968194Z","submitted_at":"2026-05-03T12:26:13Z","title":"The Cylindrical Representation Hypothesis for Language Model Steering","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-01T00:10:29.122196Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2605.01844"},"observation_digest":"sha256:7fed5457c23714d6d844fca93d4a97858de94ba89f03acf74ce2a8444f490d55","observation_id":"efe046f6-92c2-46b7-9b2f-cee2a16178d3","resolution":{"observed_at":"2026-07-01T00:15:09.223743Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":"2411.02193","doi":"10.48550/arxiv.2411.02193","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving steering vectors by targeting sparse autoencoder features.arXiv preprint arXiv:2411.02193","venue":"arXiv (Cornell University)","work_id":"a13a989e-ea2e-4d17-b6be-0378be042e41","year":2023},"citing_paper":{"arxiv_id":"2605.12671","last_updated":"2026-05-12T19:21:23Z","snapshot_observed_at":"2026-08-02T21:44:59.407489Z","submitted_at":"2026-05-12T19:21:23Z","title":"All Circuits Lead to Rome: Rethinking Functional Anisotropy in Circuit and Sheaf Discovery for LLMs","version":1},"reference_index":139,"source":"arxiv_source","source_observed_at":"2026-05-14T20:52:47.074893Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2605.12671"},"observation_digest":"sha256:2f50adf7a21c06816547b500f57ad3aee97cf42cc231e047fb6016bdafc9a983","observation_id":"65f92ce2-2593-4cf3-a524-e6b9fcbb500a","resolution":{"observed_at":"2026-05-14T20:52:57.527901Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":"2411.02193","doi":"10.48550/arxiv.2411.02193","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving steering vectors by targeting sparse autoencoder features.arXiv preprint arXiv:2411.02193","venue":"arXiv (Cornell University)","work_id":"a13a989e-ea2e-4d17-b6be-0378be042e41","year":2023},"citing_paper":{"arxiv_id":"2605.12813","last_updated":"2026-05-31T17:51:51Z","snapshot_observed_at":"2026-07-06T23:24:27.821980Z","submitted_at":"2026-05-12T23:13:50Z","title":"REALISTA: Realistic Latent Adversarial Attacks that Elicit LLM Hallucinations","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-14T20:13:10.814899Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2605.12813"},"observation_digest":"sha256:82795a6b3a0a91de1dc1385aa5b6af945c8dd3d85c63cd624ebfce2fa4018cb9","observation_id":"f511845b-8969-4720-adb8-b16a3ba7c1c8","resolution":{"observed_at":"2026-05-14T20:17:56.346581Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":"2411.02193","doi":"10.48550/arxiv.2411.02193","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving steering vectors by targeting sparse autoencoder features.arXiv preprint arXiv:2411.02193","venue":"arXiv (Cornell University)","work_id":"a13a989e-ea2e-4d17-b6be-0378be042e41","year":2023},"citing_paper":{"arxiv_id":"2605.23036","last_updated":"2026-05-21T21:00:32Z","snapshot_observed_at":"2026-08-02T00:36:01.688932Z","submitted_at":"2026-05-21T21:00:32Z","title":"Multilingual Steering by Design: Multilingual Sparse Autoencoders and Principled Layer Selection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-25T05:35:04.688774Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2605.23036"},"observation_digest":"sha256:8adb9477b318240dc3f38e3da9035d8fe423aa1784e942b04a9f406ad8325558","observation_id":"d2d3e1cc-94f8-4272-aa30-04606ceac725","resolution":{"observed_at":"2026-05-25T05:36:39.360944Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":"2411.02193","doi":"10.48550/arxiv.2411.02193","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving steering vectors by targeting sparse autoencoder features.arXiv preprint arXiv:2411.02193","venue":"arXiv (Cornell University)","work_id":"a13a989e-ea2e-4d17-b6be-0378be042e41","year":2023},"citing_paper":{"arxiv_id":"2605.23040","last_updated":"2026-05-21T21:13:14Z","snapshot_observed_at":"2026-08-02T04:36:31.374601Z","submitted_at":"2026-05-21T21:13:14Z","title":"Steered Generation via Gradient-Based Optimization on Sparse Query Features","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-25T05:31:29.510639Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2605.23040"},"observation_digest":"sha256:6202be5e740a8681c0ba7a9dda65d2c5ea3d7137026722915d5d95d673ceb6c0","observation_id":"3bc28867-5b0b-4ff6-a2ce-5d611bb1657e","resolution":{"observed_at":"2026-05-25T05:36:40.347296Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":"2411.02193","doi":"10.48550/arxiv.2411.02193","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving steering vectors by targeting sparse autoencoder features.arXiv preprint arXiv:2411.02193","venue":"arXiv (Cornell University)","work_id":"a13a989e-ea2e-4d17-b6be-0378be042e41","year":2023},"citing_paper":{"arxiv_id":"2605.28664","last_updated":"2026-05-27T15:59:45Z","snapshot_observed_at":"2026-08-07T19:59:30.749922Z","submitted_at":"2026-05-27T15:59:45Z","title":"Activation Steering for Synthetic Data Generation: The Role of Diversity in Downstream Safety Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T13:53:27.306664Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2605.28664"},"observation_digest":"sha256:ef4cff02f94e5ca48fd28e2a631b013fac7bcff26431a5271e0367bab0ea4d46","observation_id":"ed9e2903-39d0-4779-bc04-32b6c2fb40e4","resolution":{"observed_at":"2026-06-29T14:03:29.915587Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":"2411.02193","doi":"10.48550/arxiv.2411.02193","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving steering vectors by targeting sparse autoencoder features.arXiv preprint arXiv:2411.02193","venue":"arXiv (Cornell University)","work_id":"a13a989e-ea2e-4d17-b6be-0378be042e41","year":2023},"citing_paper":{"arxiv_id":"2605.28669","last_updated":"2026-05-27T16:04:35Z","snapshot_observed_at":"2026-08-09T17:08:27.404501Z","submitted_at":"2026-05-27T16:04:35Z","title":"Sense Representations Are Inducible Interfaces","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T12:35:57.341052Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2605.28669"},"observation_digest":"sha256:78730e40280ddb771a9db1383ab642bcc88ae2b910b7b8ec81c8e4bf8cbcf0d2","observation_id":"492e8566-3c24-4653-9b73-e8ab6757d336","resolution":{"observed_at":"2026-06-29T12:43:25.927568Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":"2411.02193","doi":"10.48550/arxiv.2411.02193","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving steering vectors by targeting sparse autoencoder features.arXiv preprint arXiv:2411.02193","venue":"arXiv (Cornell University)","work_id":"a13a989e-ea2e-4d17-b6be-0378be042e41","year":2023},"citing_paper":{"arxiv_id":"2606.03002","last_updated":"2026-06-04T19:39:22Z","snapshot_observed_at":"2026-08-04T10:42:06.850785Z","submitted_at":"2026-06-02T01:17:05Z","title":"Perplexity Can Miss SAE Feature Damage Under Quantization","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T11:41:18.460538Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2606.03002"},"observation_digest":"sha256:c34b26ba194376d6d7e1b122958b95ce05d1bd17f6fc1cbf0ed8140484fdfb4b","observation_id":"e7aa1c0c-293d-4012-957d-9cecb84c59f7","resolution":{"observed_at":"2026-07-02T01:36:25.775517Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":"2411.02193","doi":"10.48550/arxiv.2411.02193","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving steering vectors by targeting sparse autoencoder features.arXiv preprint arXiv:2411.02193","venue":"arXiv (Cornell University)","work_id":"a13a989e-ea2e-4d17-b6be-0378be042e41","year":2023},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:d352c03d58ab15cea8defffb669adba89b4307c410bd4d8b93188d21f629c24e","observation_id":"3caf54b0-a883-4c84-85a5-80e605dc1aeb","resolution":{"observed_at":"2026-07-02T22:57:25.979965Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-02T05:16:33.834746Z","title":"Improving steering vectors by targeting sparse autoencoder features.arXiv preprint arXiv:2411.02193,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13425","last_updated":"2026-07-15T04:03:24Z","snapshot_observed_at":"2026-08-03T17:12:53.669172Z","submitted_at":"2026-07-15T04:03:24Z","title":"Data-Efficient Adaptation of LLMs via Attention Head Reweighting","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-02T05:16:33.834746Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2607.13425"},"observation_digest":"sha256:3026e614c645cf6b921b125f301aae516e8a04a94287a1ba0513c592d7b2f7ca","observation_id":"57e5a1e5-e8bb-437e-9e79-25a1da05a53e","resolution":{"observed_at":"2026-08-02T05:16:33.834746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-02T12:14:22.541696Z","title":"arXiv preprint arXiv:2411.02193 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19364","last_updated":"2026-06-05T19:27:31Z","snapshot_observed_at":"2026-08-05T20:13:19.009303Z","submitted_at":"2026-06-05T19:27:31Z","title":"Statistically Grounded Sparse-Feature Interventions for Activation-Space Control in Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T12:14:22.541696Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2607.19364"},"observation_digest":"sha256:7eab5413ac02e7e130f38e775ae0964f3f73ca0c01fb0121df89b691848729d4","observation_id":"e6ed6efa-fd40-47f7-9eb6-a9242dcde22b","resolution":{"observed_at":"2026-08-02T12:14:22.541696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-01T10:03:54.246937Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20596","last_updated":"2026-07-22T17:33:16Z","snapshot_observed_at":"2026-08-09T06:27:26.743612Z","submitted_at":"2026-07-22T17:33:16Z","title":"Are Single-Token Sparse Autoencoder Features Causally Necessary? Layer-Depth and SAE-Family Effects","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T10:03:54.246937Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2607.20596"},"observation_digest":"sha256:030550aa32005ec559c943bd84f16dc6d5fdc7a36bcb261b903c7742b86962cd","observation_id":"889572a1-6481-45a4-8454-7b08237fae3b","resolution":{"observed_at":"2026-08-01T10:03:54.246937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-01T09:29:08.246807Z","title":", Siu, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20778","last_updated":"2026-07-22T23:00:02Z","snapshot_observed_at":"2026-08-07T13:27:58.643964Z","submitted_at":"2026-07-22T23:00:02Z","title":"Toward Mechanistic Interpretability of an AI Foundation Model Fine-Tuned for Atmospheric Chemistry","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T09:29:08.246807Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2607.20778"},"observation_digest":"sha256:08eb7ddc7d63c5403b3f67b78d50e8e2419d6ef6583497edbeeb31ddcfb63ef1","observation_id":"c4d31c6b-6113-4383-8ef4-9414b4106360","resolution":{"observed_at":"2026-08-01T09:29:08.246807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-01T03:00:44.857125Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25270","last_updated":"2026-07-28T04:18:24Z","snapshot_observed_at":"2026-08-07T23:12:57.442792Z","submitted_at":"2026-07-28T04:18:24Z","title":"Where Steering Signals Come From: Activation Source Selection in Activation Steering","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-01T03:00:44.857125Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2607.25270"},"observation_digest":"sha256:e883a15899ee29878d7bc9a1db3ed2dd544d9a5d0773cb57639135cb4fe53b32","observation_id":"e5ddab83-8554-4767-b1f0-ac42b38d2f86","resolution":{"observed_at":"2026-08-01T03:00:44.857125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-06T13:56:22.619018Z","title":"arXiv preprint arXiv:2411.02193 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04904","last_updated":"2026-08-06T04:47:27Z","snapshot_observed_at":"2026-08-09T23:10:10.629699Z","submitted_at":"2026-08-05T14:32:14Z","title":"Strengthening Target-Language Features: SAE-Based Steering for Multilingual Inference","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T13:56:22.619018Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2608.04904"},"observation_digest":"sha256:866259011b8e43aa151af8c43643d130f54a344277639bd4e8b9fc8c58d4631b","observation_id":"4d4d3ffb-4e11-41ee-9a8b-d23e084a3566","resolution":{"observed_at":"2026-08-06T13:56:22.619018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-08T17:24:54.634750Z","title":"arXiv preprint arXiv:2411.02193 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04904","last_updated":"2026-08-06T04:47:27Z","snapshot_observed_at":"2026-08-09T23:10:10.629699Z","submitted_at":"2026-08-05T14:32:14Z","title":"Strengthening Target-Language Features: SAE-Based Steering for Multilingual Inference","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T17:24:54.634750Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2608.04904"},"observation_digest":"sha256:67eaaa146f96cb0a160dc19940c9f2954186e452326fa95573e0996de58c3cd0","observation_id":"2a5b0956-a5ef-4e89-837b-69cc09f4c8ac","resolution":{"observed_at":"2026-08-08T17:24:54.634750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-11T04:17:55.782849Z","title":"Improving steering vectors by targeting sparse autoencoder features.arXiv preprint arXiv:2411.02193, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-11T12:24:52.670492Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.782849Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:83d444a5cbf1d29acba437cc12565fd9cb102763d16d79013e60d39eb30db628","observation_id":"bae5706b-c4c3-4713-829f-3cfd8479df19","resolution":{"observed_at":"2026-08-11T04:17:55.782849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.02193/citation-record","integrity":"/paper/2411.02193/integrity","json":"/paper/2411.02193/citation-record.json","paper":"/paper/2411.02193"},"outbound":[],"paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T11:08:29.370811Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 26 inbound Pith citation observations for arXiv:2411.02193."}