{"as_of":"2026-08-06T04:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b063d7a8971b70b4554b0bb21be87d491f24bfeaa6e0584bcf8e42748a00ef0a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":32,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T17:26:48.585241Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":3,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T17:26:48.585241Z","title":"Llama scope: Extracting millions of features from llama-3.1-8b with sparse autoencoders.arXiv preprint arXiv:2410.20526, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.16318","last_updated":"2025-09-01T08:35:27Z","snapshot_observed_at":"2026-08-05T17:26:46.427457Z","submitted_at":"2025-08-22T11:57:55Z","title":"SATORI: Static Test Oracle Generation for REST APIs","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T17:26:48.585241Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2508.16318"},"observation_digest":"sha256:335ee3e04dbcbdd8ff2e75dc9dc537b2bfea04b867760d354d4191dbf2555eb7","observation_id":"4bc6fdef-2e70-4549-a5b4-d1e4717be92c","resolution":{"observed_at":"2026-08-05T17:26:48.585241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T17:16:33.055842Z","title":"URL https: //doi.org/10.48550/arXiv.2410.20526","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.16930","last_updated":"2025-08-23T07:30:18Z","snapshot_observed_at":"2026-08-05T17:16:27.324589Z","submitted_at":"2025-08-23T07:30:18Z","title":"HunyuanVideo-Foley: Multimodal Diffusion with Representation Alignment for High-Fidelity Foley Audio Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T17:16:33.055842Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2508.16930"},"observation_digest":"sha256:c27f2edc5dac53eeb81a99fb4361c99d3e87787f7aa2c315ea02932ca19d9f6b","observation_id":"5698882d-c7a7-4f81-98df-faad84fcd714","resolution":{"observed_at":"2026-08-05T17:16:33.055842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T14:22:30.595697Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21448","last_updated":"2026-06-02T08:58:05Z","snapshot_observed_at":"2026-08-05T14:22:28.949033Z","submitted_at":"2025-08-29T09:27:01Z","title":"When Models Refuse: Political Steerability and Feature Richness as Measures of Ideological Depth","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:30.595697Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2508.21448"},"observation_digest":"sha256:b113d86a71a0e5fcdf9d3f185362ba000edbadc659df8ca5819d268120efc51f","observation_id":"5e0bcefc-5bed-41ad-9f0d-67f3aa10abcc","resolution":{"observed_at":"2026-08-05T14:22:30.595697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2509.18127","last_updated":"2026-04-14T10:00:44Z","snapshot_observed_at":"2026-08-02T17:25:00.233548Z","submitted_at":"2025-09-11T11:22:43Z","title":"Safe-SAIL: Towards a Fine-grained Safety Landscape of Large Language Models via Sparse Autoencoder Interpretation Framework","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-18T18:13:01.662828Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2509.18127"},"observation_digest":"sha256:d707ddfe6c147ab3bbc70cec4d07d69518bb04e25fdd148c6e48d610db7a4a9f","observation_id":"b7efdee6-ed2f-45ee-89f0-9a8a067e5e4b","resolution":{"observed_at":"2026-05-18T18:16:43.753837Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-04T15:20:32.165968Z","title":"Llama scope: Extracting millions of features from llama-3.1-8b with sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.20784","last_updated":"2026-05-29T09:11:25Z","snapshot_observed_at":"2026-08-04T15:20:13.853602Z","submitted_at":"2025-09-25T06:13:05Z","title":"Towards Atoms of Large Language Models","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T15:20:32.165968Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2509.20784"},"observation_digest":"sha256:bdf0cc75eced4e5dd646ad05894093ed84813b1753f99a79b6c53e2ebad575ed","observation_id":"f7debc33-1c98-417d-9279-3b3b7223897b","resolution":{"observed_at":"2026-08-04T15:20:32.165968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2601.14004","last_updated":"2026-04-14T03:49:06Z","snapshot_observed_at":"2026-07-31T09:24:49.481740Z","submitted_at":"2026-01-20T14:23:23Z","title":"Locate, Steer, and Improve: A Practical Survey of Actionable Mechanistic Interpretability in Large Language Models","version":4},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-05-16T12:39:57.398423Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2601.14004"},"observation_digest":"sha256:96dc7016d10b393a6fd321b1027b471270d24ed788cfaa1fe452c270fe4a093f","observation_id":"1491b3f6-15cd-40b5-91be-a605761b234d","resolution":{"observed_at":"2026-05-16T12:40:54.699308Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-03T06:35:33.800432Z","title":"Hindupur, S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.22594","last_updated":"2026-06-11T01:15:40Z","snapshot_observed_at":"2026-08-03T06:35:15.950496Z","submitted_at":"2026-01-30T05:41:19Z","title":"Language Model Circuits Are Sparse in the Neuron Basis","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T06:35:33.800432Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2601.22594"},"observation_digest":"sha256:d497e576785de7a3655d8b6b8202d325d3ecba505f33be02596e960512297d73","observation_id":"6a47acc6-3553-492c-ac78-6c0fc4987e5a","resolution":{"observed_at":"2026-08-03T06:35:33.800432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-03T01:14:58.085415Z","title":"Ghandeharioun, A., Caciularu, A., Pearce, A., Dixon, L., and Geva, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-06T01:08:22.482910Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":600,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:58.085415Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:db39bccb51f704809d54a1ca633185512daff2001ccd55cb17c5cc367dc9787c","observation_id":"feddd9b1-463e-42c8-acff-10c4c15954d3","resolution":{"observed_at":"2026-08-03T01:14:58.085415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-04T05:36:47.887167Z","title":"Llama scope: Extracting millions of features from llama-3.1-8b with sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03532","last_updated":"2026-08-02T18:42:26Z","snapshot_observed_at":"2026-08-06T04:34:44.929703Z","submitted_at":"2026-04-04T00:56:13Z","title":"LangFIR: Discovering Sparse Language-Specific Features from Monolingual Data for Language Steering","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T05:36:47.887167Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2604.03532"},"observation_digest":"sha256:5726d39a7a890713c920363c22ac9c87feccb97f53fa3f58c465fbec33553556","observation_id":"dca8806d-4c3a-4414-a648-faff8fc52a49","resolution":{"observed_at":"2026-08-04T05:36:47.887167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2604.11297","last_updated":"2026-04-13T10:59:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-13T10:59:28Z","title":"The Past Is Not Past: Memory-Enhanced Dynamic Reward Shaping","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T15:34:31.715954Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2604.11297"},"observation_digest":"sha256:e57ebfdf3c1979f1b0344d720e9aa9862a60c9bdfb51485a0884d731e18a3332","observation_id":"01801f0c-9b33-4699-b891-51ecca4002d3","resolution":{"observed_at":"2026-05-10T15:35:32.765091Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2604.14090","last_updated":"2026-04-15T17:06:25Z","snapshot_observed_at":"2026-07-06T23:01:55.698452Z","submitted_at":"2026-04-15T17:06:25Z","title":"From Weights to Activations: Is Steering the Next Frontier of Adaptation?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T12:52:58.193141Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2604.14090"},"observation_digest":"sha256:77c768b4c18c42d6e753c88be776edf69d4e185ad980a807ae7b66f00fe548a2","observation_id":"b2b331e2-e670-4319-a9fb-8dce35d6a686","resolution":{"observed_at":"2026-05-10T12:55:24.615581Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2604.19974","last_updated":"2026-04-21T20:34:14Z","snapshot_observed_at":"2026-07-06T23:06:31.110859Z","submitted_at":"2026-04-21T20:34:14Z","title":"Are LLM Uncertainty and Correctness Encoded by the Same Features? A Functional Dissociation via Sparse Autoencoders","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-10T02:51:12.492123Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2604.19974"},"observation_digest":"sha256:b24fd384a71e9e3c8893787762de4add1298d248f83c4225836afad96cb07170","observation_id":"fc9ee04c-7102-4d90-96b3-9762fdfc9708","resolution":{"observed_at":"2026-05-10T02:53:29.657509Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2604.23877","last_updated":"2026-04-26T20:37:26Z","snapshot_observed_at":"2026-07-06T23:10:02.659384Z","submitted_at":"2026-04-26T20:37:26Z","title":"Knowledge Vector of Logical Reasoning in Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T06:02:28.444902Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2604.23877"},"observation_digest":"sha256:a4730a5e1cd61169502fd4f97b3310b18a11e47a6ac93d965e9bfe885b58958a","observation_id":"0c2306d6-a71d-435a-b291-185108bad2fb","resolution":{"observed_at":"2026-05-11T21:16:32.876799Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2605.02234","last_updated":"2026-05-04T05:09:21Z","snapshot_observed_at":"2026-07-06T23:15:23.301944Z","submitted_at":"2026-05-04T05:09:21Z","title":"Bucketing the Good Apples: A Method for Diagnosing and Improving Causal Abstraction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T19:12:30.627633Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.02234"},"observation_digest":"sha256:840b423e3c62e3279412166aa68ab84166198b79971451f3d184434ca04ccac2","observation_id":"e7682740-a95d-43ff-a262-27a7b1e7cd8e","resolution":{"observed_at":"2026-05-09T06:00:36.281729Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2605.03052","last_updated":"2026-05-29T18:13:59Z","snapshot_observed_at":"2026-07-06T23:16:00.796105Z","submitted_at":"2026-05-04T18:17:05Z","title":"How Language Models Process Negation","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-08T18:28:29.824790Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.03052"},"observation_digest":"sha256:0cd8b81063009b969b32526ab5626159ef6733c9c2ee178bab768fd1ec517bfe","observation_id":"5e323262-9627-4746-8f89-d802ab54aa8d","resolution":{"observed_at":"2026-05-09T06:25:45.389251Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2605.03052","last_updated":"2026-05-29T18:13:59Z","snapshot_observed_at":"2026-07-06T23:16:00.796105Z","submitted_at":"2026-05-04T18:17:05Z","title":"How Language Models Process Negation","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-01T00:10:03.686212Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.03052"},"observation_digest":"sha256:15842c6a148d6aab35e78848ff2994852d2506e392edbbd62707565b66091465","observation_id":"1412c016-d18f-4dd4-a764-2351ea339a63","resolution":{"observed_at":"2026-07-01T00:15:09.371689Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2605.03160","last_updated":"2026-07-25T20:25:34Z","snapshot_observed_at":"2026-08-02T14:57:38.720241Z","submitted_at":"2026-05-04T21:11:21Z","title":"Steering grids for sparse-autoencoder features: when a top-context label names an activation regime rather than a causal axis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T18:52:01.624279Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.03160"},"observation_digest":"sha256:6fd225df194f8073233db6dfae3ff087bcf0cf3e54e80fc830424c978e5182c0","observation_id":"a6d8e159-28d7-437e-b541-8774363c8e87","resolution":{"observed_at":"2026-05-09T06:10:37.078332Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-02T14:57:40.198964Z","title":"Kenneth Li, Oam Patel, Fernanda Viégas, Hanspeter Pfister, and Martin Wattenberg","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.03160","last_updated":"2026-07-25T20:25:34Z","snapshot_observed_at":"2026-08-02T14:57:38.720241Z","submitted_at":"2026-05-04T21:11:21Z","title":"Steering grids for sparse-autoencoder features: when a top-context label names an activation regime rather than a causal axis","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T14:57:40.198964Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.03160"},"observation_digest":"sha256:494805464dea8607414198558d0f275736b7e16dda58ee442a107dc962427094","observation_id":"2b9d8e00-97e1-455c-b3b2-eb8556d2584f","resolution":{"observed_at":"2026-08-02T14:57:40.198964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2605.12874","last_updated":"2026-05-13T01:41:38Z","snapshot_observed_at":"2026-07-06T23:24:32.412966Z","submitted_at":"2026-05-13T01:41:38Z","title":"Descriptive Collision in Sparse Autoencoder Auto-Interpretability: When One Explanation Describes Many Features","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:38.363693Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.12874"},"observation_digest":"sha256:b4fc1bdae68bb76944abc4a94f74b2385bd35522e03af0ac681f3eb0973dd505","observation_id":"844ab031-b11e-491b-98fb-cfd37c219db2","resolution":{"observed_at":"2026-05-14T20:27:58.939127Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2605.23036","last_updated":"2026-05-21T21:00:32Z","snapshot_observed_at":"2026-08-02T00:36:01.688932Z","submitted_at":"2026-05-21T21:00:32Z","title":"Multilingual Steering by Design: Multilingual Sparse Autoencoders and Principled Layer Selection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-25T05:35:04.688774Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.23036"},"observation_digest":"sha256:4142c0159fa1265c8ab5be87ffdea1c6ed33d33d73f72a5cc12177a967c21eac","observation_id":"3fd20e04-d2c2-4da1-8562-72a8335a1a12","resolution":{"observed_at":"2026-05-25T05:36:39.343151Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2605.27819","last_updated":"2026-05-27T01:27:53Z","snapshot_observed_at":"2026-07-06T23:37:31.844094Z","submitted_at":"2026-05-27T01:27:53Z","title":"ReSAE: Residualized Sparse Autoencoders for Multi-Layer Transformer Interventions","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T14:53:40.774927Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.27819"},"observation_digest":"sha256:44fbb23da8bcd433b4699b0e8596daf4500579c93834900ee302a3e472c38d3b","observation_id":"353ca87a-e502-4550-bac0-9ee30ab4cf4b","resolution":{"observed_at":"2026-06-29T15:03:31.590058Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2605.28149","last_updated":"2026-08-04T06:19:42Z","snapshot_observed_at":"2026-08-06T03:25:15.214419Z","submitted_at":"2026-05-27T08:31:43Z","title":"Sign-Aware Gated Sparse Autoencoders: Modeling Anticorrelated Features with Bi-Jump-ReLU Activations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T14:16:44.232080Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.28149"},"observation_digest":"sha256:76d1df698ddb6d5fee6b89950c18aa7aa234f2794034502c5e8a1cf3433422ad","observation_id":"d250513c-cd86-4bf2-8496-939a085faab0","resolution":{"observed_at":"2026-06-29T14:23:30.743712Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-04T05:02:51.322308Z","title":"Llama scope: Extracting millions of features from llama-3.1-8b with sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.28149","last_updated":"2026-08-04T06:19:42Z","snapshot_observed_at":"2026-08-06T03:25:15.214419Z","submitted_at":"2026-05-27T08:31:43Z","title":"Sign-Aware Gated Sparse Autoencoders: Modeling Anticorrelated Features with Bi-Jump-ReLU Activations","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T05:02:51.322308Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.28149"},"observation_digest":"sha256:c737f7bcc2c91d8be85db84c1b4f5b29c7d86e182e0e3850bb547c6ad99dec48","observation_id":"9a2027af-1fd8-47ee-bdfa-59c6a4b40419","resolution":{"observed_at":"2026-08-04T05:02:51.322308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2605.28649","last_updated":"2026-05-27T15:52:39Z","snapshot_observed_at":"2026-07-06T23:38:14.056361Z","submitted_at":"2026-05-27T15:52:39Z","title":"Interpretability-Guided Layer Selection over Subspace Projection: SAEs as Stethoscopes, Not Scalpels, for Raw Task Vector Model Editing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T14:00:31.962058Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.28649"},"observation_digest":"sha256:4752df1ccba5c894be407c7a51ee63540af70a52f538836b28b3c4b1c5328bbe","observation_id":"61b68d60-8695-47bb-bbbd-ad7bc12dd4d0","resolution":{"observed_at":"2026-06-29T14:03:29.443692Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2606.00356","last_updated":"2026-06-03T03:59:07Z","snapshot_observed_at":"2026-08-01T16:45:43.116377Z","submitted_at":"2026-05-29T20:59:28Z","title":"How Far Do Auto-Interpretation Labels Generalize: A Controlled Study Across Languages, Scripts, and Rewordings","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-06-28T22:02:13.297140Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2606.00356"},"observation_digest":"sha256:0db8a13fb54af27d869f24f0b50a92dfec16eee248865d46b2420bf8b130f5ee","observation_id":"af4d1441-e7e8-4c56-99fd-494dd62c61f4","resolution":{"observed_at":"2026-07-01T19:46:11.043660Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2606.08267","last_updated":"2026-06-06T17:27:38Z","snapshot_observed_at":"2026-07-06T23:47:48.634024Z","submitted_at":"2026-06-06T17:27:38Z","title":"Post-AGI Economies: Superposition and the Second Fundamental Theorem of Welfare Economics","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-27T18:56:37.173132Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2606.08267"},"observation_digest":"sha256:17351f125aa8b2d7f95cf1bca6115f7840ccc6284d906f8d8c6a08f5f0aedad8","observation_id":"268b9d15-03fd-4494-a92f-09cb4f3094a8","resolution":{"observed_at":"2026-07-02T22:27:25.653185Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2606.26620","last_updated":"2026-06-25T05:33:03Z","snapshot_observed_at":"2026-08-01T23:34:10.702117Z","submitted_at":"2026-06-25T05:33:03Z","title":"Discovering Millions of Interpretable Features with Sparse Autoencoders","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-26T05:34:00.754172Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2606.26620"},"observation_digest":"sha256:6fe3f6b8f73d1c60f3e63c21cce6febf80b5436c41ac45e71fb41d77afaba4de","observation_id":"8968abbf-079b-4376-b671-7c33051b203f","resolution":{"observed_at":"2026-07-04T12:59:53.068921Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2607.00397","last_updated":"2026-07-01T03:48:49Z","snapshot_observed_at":"2026-07-07T00:06:03.968882Z","submitted_at":"2026-07-01T03:48:49Z","title":"NeuroCogMap Reveals Cognitive Organization of Large Language Models","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-07-02T02:36:32.233113Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2607.00397"},"observation_digest":"sha256:1129ee57edbb16e21182050a9bbc712afe7f676832a45870e357e40051693d6f","observation_id":"88194d69-50b9-4d5e-b068-383929996362","resolution":{"observed_at":"2026-07-02T02:46:27.620414Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Dan Hendrycks, Collin Burns, Steven Basart, Andy Zou, Mantas Mazeika, Dawn Song, and Jacob Steinhardt","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-02T08:49:17.463451Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:488f87db92ed54913a6ef3e5469ef8a7e7aeda6c99016e8a0103d3a7f8d2a08a","observation_id":"60b03b10-a014-49a2-907e-824206c2bffa","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-01T10:03:56.027290Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20596","last_updated":"2026-07-22T17:33:16Z","snapshot_observed_at":"2026-08-04T06:09:05.828651Z","submitted_at":"2026-07-22T17:33:16Z","title":"Are Single-Token Sparse Autoencoder Features Causally Necessary? Layer-Depth and SAE-Family Effects","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T10:03:56.027290Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2607.20596"},"observation_digest":"sha256:190a910a128cf16808db146f5b65ef9fc8fcedd773de6c6d9180210621a8b39c","observation_id":"b5f720c7-61e1-47f8-a0ca-3c7110429a39","resolution":{"observed_at":"2026-08-01T10:03:56.027290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-01T03:00:44.868666Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25270","last_updated":"2026-07-28T04:18:24Z","snapshot_observed_at":"2026-08-02T19:02:07.047427Z","submitted_at":"2026-07-28T04:18:24Z","title":"Where Steering Signals Come From: Activation Source Selection in Activation Steering","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-01T03:00:44.868666Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2607.25270"},"observation_digest":"sha256:1fa1a41337489ddc9049441d59f483fa46d75aebc659529894ef87e253688577","observation_id":"a323459e-dba7-4de9-9f43-9d2a1f96896d","resolution":{"observed_at":"2026-08-01T03:00:44.868666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-01T01:13:36.771985Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25907","last_updated":"2026-07-28T16:01:48Z","snapshot_observed_at":"2026-08-03T16:20:17.549334Z","submitted_at":"2026-07-28T16:01:48Z","title":"Minimizing Targeted Activations: Input-Only Suppression of Evaluation-Awareness Latents in Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T01:13:36.771985Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2607.25907"},"observation_digest":"sha256:8a4a6da9211ff0f4d5f2927d5aa4ff58dfe7de0c512990faba237585834f22c4","observation_id":"fcf4e245-00ab-4d35-9255-faf36a8d63f5","resolution":{"observed_at":"2026-08-01T01:13:36.771985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.20526/citation-record","integrity":"/paper/2410.20526/integrity","json":"/paper/2410.20526/citation-record.json","paper":"/paper/2410.20526"},"outbound":[],"paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 32 inbound Pith citation observations for arXiv:2410.20526."}