{"as_of":"2026-08-08T03:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:300eeb5f31345062f464b9d3c89dadd03fb3e977391be4b5423864f8a72447fe","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:44:44.021955Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:30:05.981400Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17769","snapshot_observed_at":"2026-08-07T12:30:05.981400Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24360","last_updated":"2025-07-10T23:59:56Z","snapshot_observed_at":"2026-08-07T12:22:41.044929Z","submitted_at":"2025-05-30T08:53:27Z","title":"Interpreting Large Text-to-Image Diffusion Models with Dictionary Learning","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:05.981400Z"},"links":{"cited_paper":"/paper/2505.17769","citing_paper":"/paper/2505.24360"},"observation_digest":"sha256:3707033445a261e76e87b57679746de5199288bc5cc205ed26e16bcc2ce13a8d","observation_id":"9a01235e-b8c4-41b5-b0e7-4b43a850fa71","resolution":{"observed_at":"2026-08-07T12:30:05.981400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"cited_work":{"arxiv_id":"2505.17769","doi":"10.48550/arxiv.2505.17769","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17769","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Inference-time decomposition of activations (itda): A scalable approach to interpreting large language models.arXiv preprint arXiv:2505.17769,","venue":"arXiv (Cornell University)","work_id":"a3e5aaf0-26c0-43b5-bb02-304a2029310c","year":null},"citing_paper":{"arxiv_id":"2606.06333","last_updated":"2026-06-04T16:08:25Z","snapshot_observed_at":"2026-08-02T07:30:20.394633Z","submitted_at":"2026-06-04T16:08:25Z","title":"Subspace-Aware Sparse Autoencoders for Effective Mechanistic Interpretability","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-28T02:07:18.198225Z"},"links":{"cited_paper":"/paper/2505.17769","citing_paper":"/paper/2606.06333"},"observation_digest":"sha256:4001699c89e0e8ca959f08919aed77c49b584dee319d2e9d006cb473410f53ae","observation_id":"07c2b787-83be-431b-982d-1ba09205994c","resolution":{"observed_at":"2026-06-28T02:11:29.076262Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"cited_work":{"arxiv_id":"2505.17769","doi":"10.48550/arxiv.2505.17769","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17769","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Inference-time decomposition of activations (itda): A scalable approach to interpreting large language models.arXiv preprint arXiv:2505.17769,","venue":"arXiv (Cornell University)","work_id":"a3e5aaf0-26c0-43b5-bb02-304a2029310c","year":null},"citing_paper":{"arxiv_id":"2606.11722","last_updated":"2026-06-10T06:53:58Z","snapshot_observed_at":"2026-08-02T23:00:11.313609Z","submitted_at":"2026-06-10T06:53:58Z","title":"ICA Lens: Interpreting Language Models Without Training Another Dictionary","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T10:21:58.878499Z"},"links":{"cited_paper":"/paper/2505.17769","citing_paper":"/paper/2606.11722"},"observation_digest":"sha256:93f425ad55ceb8c1532a5dc81bb842f82bcec4dc443ac2a6ca513dbe80192011","observation_id":"1bc492b3-4fc2-4105-8c10-ad0773b3201f","resolution":{"observed_at":"2026-07-03T09:37:49.254240Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.17769/citation-record","integrity":"/paper/2505.17769/integrity","json":"/paper/2505.17769/citation-record.json","paper":"/paper/2505.17769"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:44.760885Z","title":null,"venue":null,"work_id":"8ef5e82c-7465-4402-aa34-7dfd07a85953","year":2023},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:43.886394Z"},"links":{"citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:a69725aa2bc62075a09a2b8eaba599e50b7c6c2f0ecffe387717e6cd68e5a214","observation_id":"1eb949d6-74e7-4814-bbc5-c075ff6d2631","resolution":{"observed_at":"2026-08-07T14:44:44.853884Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:47.393121Z","title":"Transcoders find interpretable llm feature circuits.NeurIPS 2024,","venue":null,"work_id":"81ff6b6b-bf6b-4227-96e6-ff8ec21fb24a","year":2024},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:42.124703Z"},"links":{"citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:370f0ac12d0b0ecd78ac862f2fb6d65e44f7071bfe04cbf4fd21fb330b4c9288","observation_id":"95cf4d0e-bbed-420d-a53d-8889a9194442","resolution":{"observed_at":"2026-08-07T14:44:47.548746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-07T14:44:42.345620Z","title":"The pile: An 800gb dataset of diverse text for language modeling.arXiv preprint arXiv:2101.00027,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:42.345620Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:1ed6cb4693890be7a682bcde4411db5e1333c67f1352376eb8f894f46584f823","observation_id":"553005ea-e8d6-45c2-96de-9ef16933b1f6","resolution":{"observed_at":"2026-08-07T14:44:42.345620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:42.427740Z","title":"Sparse autoencoders can interpret randomly initialized transform- ers.arXiv preprint arXiv:2501.17727,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:42.427740Z"},"links":{"citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:0291212b05630f1363b329398f8c624587d6a64f8b5fd7647614171316aba95c","observation_id":"f702ad0c-155d-4fb8-a23a-8fbcada5dd0d","resolution":{"observed_at":"2026-08-07T14:44:42.427740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:46.769842Z","title":"Saebench: A comprehensive benchmark for sparse autoencoders, December 2024a","venue":null,"work_id":"64775260-cb56-40a8-baab-b7d15ea4d1b0","year":2025},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:42.693061Z"},"links":{"citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:31a5bdc78815b97392529a04f888b32935f5e3f021b8bfe9d8ead1d526c1da30","observation_id":"fccb8e5c-b84c-4302-bd2b-387b3bae6f71","resolution":{"observed_at":"2026-08-07T14:44:46.831434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05147","last_updated":"2024-08-19T07:51:05Z","snapshot_observed_at":"2026-08-04T11:44:14.524984Z","submitted_at":"2024-08-09T16:06:42Z","title":"Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05147","snapshot_observed_at":"2026-08-07T14:44:42.856429Z","title":"Lindsey, J., Templeton, A., Marcus, J., Conerly, T., Batson, J., and Olah, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:42.856429Z"},"links":{"cited_paper":"/paper/2408.05147","citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:2c920e180c079c6952e7ae2c02a9146eeed6ea12ef4790462eb585b00f84a578","observation_id":"bb2d5175-7072-4bf8-8535-571c78840d20","resolution":{"observed_at":"2026-08-07T14:44:42.856429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13928","last_updated":"2025-08-06T13:47:10Z","snapshot_observed_at":"2026-07-06T19:35:35.229351Z","submitted_at":"2024-10-17T17:56:01Z","title":"Automatically Interpreting Millions of Features in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13928","snapshot_observed_at":"2026-08-07T14:44:43.094342Z","title":"Automati- cally interpreting millions of features in large language models.arXiv preprint arXiv:2410.13928,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:43.094342Z"},"links":{"cited_paper":"/paper/2410.13928","citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:63866945a9ccefaa2c404b8e591cd34320119f97c8a872140704a718b2bf5411","observation_id":"ec0bdb8c-202d-4452-97e6-e8969bf8b555","resolution":{"observed_at":"2026-08-07T14:44:43.094342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16496","last_updated":"2025-01-27T20:57:18Z","snapshot_observed_at":"2026-07-06T20:27:04.664873Z","submitted_at":"2025-01-27T20:57:18Z","title":"Open Problems in Mechanistic Interpretability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16496","snapshot_observed_at":"2026-08-07T14:44:43.200839Z","title":"Open problems in mechanistic interpretability.arXiv preprint arXiv:2501.16496,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:43.200839Z"},"links":{"cited_paper":"/paper/2501.16496","citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:f8b9778b3cd63bc61d19303eb79b5d4d02697c455fec8441079981d752498b86","observation_id":"3da134b9-22d9-4cf2-a558-34b803115ff3","resolution":{"observed_at":"2026-08-07T14:44:43.200839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-07T14:44:43.266471Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahri- ari, B., Ram ´e, A., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:43.266471Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:df1a77c1f1c74a3a7cee97e5328fdbf93487800a751de0f24ae0d6a3a1225ca4","observation_id":"7846871d-511e-456a-9974-81962e89e6e5","resolution":{"observed_at":"2026-08-07T14:44:43.266471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:46.573736Z","title":"This provides a gradient for training unlike the L0-norm, but suppresses latent activations harming reconstruction performance (Rajamanoharan et al., 2025)","venue":null,"work_id":"9f3777dd-ca76-46b7-85c7-2ade1ed361e6","year":2023},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:43.340229Z"},"links":{"citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:b87252617c970d57668868190525ce9ba418a91d8504c2ab1e30b43e96d5e0a5","observation_id":"fe01fa85-282d-4f04-bed8-48b550b34cd2","resolution":{"observed_at":"2026-08-07T14:44:46.666826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:46.365680Z","title":null,"venue":null,"work_id":"5e04e410-c27b-481b-a8da-6d05ade77327","year":2025},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:43.399490Z"},"links":{"citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:f7ce4bf96bd891e494b1f5472764eb55ffe8760ffc3fd5755f632ff69b43e60a","observation_id":"51713ab3-57c2-46f3-a3b1-4110885fe4af","resolution":{"observed_at":"2026-08-07T14:44:46.498614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:46.118507Z","title":null,"venue":null,"work_id":"9a6849d4-b8d0-4fac-9644-adf175e85b36","year":2024},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:43.462849Z"},"links":{"citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:be291905d4faecf3c31bde9d93c3aabd03b994644b02fc395110e048a377d397","observation_id":"6f0f4803-afca-4f43-a14f-e38d55c8cd70","resolution":{"observed_at":"2026-08-07T14:44:46.240958Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:45.812947Z","title":"How Idris Elba’s ’Luther’ Puts Us in the Mind set of a Renegade Detective. “Luther","venue":null,"work_id":"1eff1637-d53a-4102-9618-430233656984","year":2020},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:43.531016Z"},"links":{"citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:b0fb147b21f30a956f37fe07c222a1934729ac82e776a5d856a722882f9f368c","observation_id":"d7319a43-23fd-46ef-b04f-c6ea37c880bc","resolution":{"observed_at":"2026-08-07T14:44:45.984384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:44.957650Z","title":null,"venue":null,"work_id":"b9e6c8b9-cdc7-4123-bfc0-3ec9eca17307","year":1993},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:43.814978Z"},"links":{"citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:17cb8bbd056adda2d42c32a5b01e2d0cd2610a979989299d7758b016fd7b3a95","observation_id":"a68772e7-5935-42b2-ba35-6f68e4c4d106","resolution":{"observed_at":"2026-08-07T14:44:45.051445Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:45.145590Z","title":"Robot-assisted laparoscopic renal artery aneurysm repair with selective arterial clamping. Renal artery aneurysms represent a rare clinical","venue":null,"work_id":"40c6b356-33e5-46a0-bd5c-b21959417f29","year":1946},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:43.732885Z"},"links":{"citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:a9b4999a88b9dbc9334f3b1dc288e3ef0e941dee8df2a1a6a2bfcffc7147b29c","observation_id":"7991f56e-153a-4269-85b8-96986cfe076d","resolution":{"observed_at":"2026-08-07T14:44:45.264819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:44.408486Z","title":"Note the higher similarity within model architectures","venue":null,"work_id":"8675c810-5335-4bde-8d92-d18950971ad5","year":2017},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:44.021955Z"},"links":{"citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:facb5ef8ff163f6939f49fcb878734e5605b71d4fbd61740262f2ae6b9d174c6","observation_id":"a63b0e38-20d1-4c67-939a-c4b5fe721a7e","resolution":{"observed_at":"2026-08-07T14:44:44.489730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:45.617541Z","title":"Activations of 0 are omitted for legibility","venue":null,"work_id":"7085801e-91a1-423e-aba1-066243548865","year":1999},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:43.604648Z"},"links":{"citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:303ca75959fe69e19bf6f24cbc348754f6bf4c2f53b5a35d92f1ef5fcd6e7391","observation_id":"b4cb0a66-9821-4f67-8879-f555e90d1bc7","resolution":{"observed_at":"2026-08-07T14:44:45.716451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-08-07T14:44:43.035887Z","title":"In-context learning and induction heads.arXiv preprint arXiv:2209.11895,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":1997,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:43.035887Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:753a2c78ca9fe0f49c364ed63508315a12f9013f204dc025537117d6bf443f12","observation_id":"47f1ae1d-9832-43e7-8e90-68d2d089344c","resolution":{"observed_at":"2026-08-07T14:44:43.035887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.01644","last_updated":"2018-11-22T23:40:00Z","snapshot_observed_at":"2026-07-06T05:13:30.860932Z","submitted_at":"2016-10-05T20:59:01Z","title":"Understanding intermediate layers using linear classifier probes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01644","snapshot_observed_at":"2026-08-07T14:44:41.885452Z","title":"Understanding intermediate layers using linear classifier probes.arXiv preprint arXiv:1610.01644,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:41.885452Z"},"links":{"cited_paper":"/paper/1610.01644","citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:81b7642bbaf0b386348e1b669b620f998cf5769672b723db5f3ef7fc94a43cf4","observation_id":"9a02851f-305b-48d0-81b0-d0c0a4809ffe","resolution":{"observed_at":"2026-08-07T14:44:41.885452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16681","last_updated":"2025-02-23T18:54:15Z","snapshot_observed_at":"2026-08-07T17:54:50.710564Z","submitted_at":"2025-02-23T18:54:15Z","title":"Are Sparse Autoencoders Useful? A Case Study in Sparse Probing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.16681","snapshot_observed_at":"2026-08-07T14:44:42.625025Z","title":"Are sparse autoencoders useful? a case study in sparse probing.arXiv preprint arXiv:2502.16681,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:42.625025Z"},"links":{"cited_paper":"/paper/2502.16681","citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:1e4b3d35f0a83df12f95a997c3c47a2ddeabb3c282e667b0d4c7684d1c46c9f0","observation_id":"65bad93b-77de-4a8e-b1ae-a764b8847d95","resolution":{"observed_at":"2026-08-07T14:44:42.625025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06981","last_updated":"2025-05-21T00:01:46Z","snapshot_observed_at":"2026-08-07T14:16:41.337428Z","submitted_at":"2024-10-09T15:18:57Z","title":"Quantifying Feature Space Universality Across Large Language Models via Sparse Autoencoders","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06981","snapshot_observed_at":"2026-08-07T14:44:42.785494Z","title":"Quantifying feature space universality across large language models via sparse autoencoders.arXiv preprint arXiv:2410.06981,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:42.785494Z"},"links":{"cited_paper":"/paper/2410.06981","citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:43d2697de06367ea9813585c8081f7854a1ec4d20ae1012789913ad9709c9f7d","observation_id":"70983da0-1086-49b3-831e-33292b241dce","resolution":{"observed_at":"2026-08-07T14:44:42.785494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14561","last_updated":"2025-04-01T16:04:53Z","snapshot_observed_at":"2026-07-06T18:49:16.284410Z","submitted_at":"2024-07-18T17:59:01Z","title":"NNsight and NDIF: Democratizing Access to Open-Weight Foundation Model Internals","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14561","snapshot_observed_at":"2026-08-07T14:44:42.266153Z","title":"R., Todd, E., Brinkmann, J., Juang, C., Pal, K., Rager, C., Mueller, A., Marks, S., Sharma, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:42.266153Z"},"links":{"cited_paper":"/paper/2407.14561","citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:9d3753af3433ebda8a16425970cb8366aa968fa781f019897f447aa0a3b8cefc","observation_id":"b1cb3b1f-d3e1-4ee0-8524-64eaff27958d","resolution":{"observed_at":"2026-08-07T14:44:42.266153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5663","last_updated":"2014-03-22T17:12:07Z","snapshot_observed_at":"2026-08-01T16:20:01.675800Z","submitted_at":"2013-12-19T17:46:46Z","title":"k-Sparse Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5663","snapshot_observed_at":"2026-08-07T14:44:42.916690Z","title":"Mallat, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:42.916690Z"},"links":{"cited_paper":"/paper/1312.5663","citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:0e7ed44fdcacbee2b5622e4068a12bc9a1e356b800b633c632188fb80f5cae67","observation_id":"0df4e643-97e8-468a-b609-12cafd42f614","resolution":{"observed_at":"2026-08-07T14:44:42.916690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14435","last_updated":"2024-08-01T17:42:04Z","snapshot_observed_at":"2026-07-06T18:49:06.836479Z","submitted_at":"2024-07-19T16:07:19Z","title":"Jumping Ahead: Improving Reconstruction Fidelity with JumpReLU Sparse Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14435","snapshot_observed_at":"2026-08-07T14:44:43.148233Z","title":"Jumping ahead: Improving reconstruction fidelity with jumprelu sparse autoencoders.arXiv preprint arXiv:2407.14435,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:43.148233Z"},"links":{"cited_paper":"/paper/2407.14435","citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:0bf99808017c9f158d13e97a80fab78a665e73d464bb5247e7279fb24207083e","observation_id":"06cee725-277b-45a1-a9c7-2dc6f15635da","resolution":{"observed_at":"2026-08-07T14:44:43.148233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:44.581082Z","title":"SAEBench metrics were created for evaluating SAEs, which limits their applicability to ITDAs","venue":null,"work_id":"61aa8ba6-977d-4f65-9c82-ce3c4fbff962","year":2025},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:43.956360Z"},"links":{"citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:efb26ccbc1f86fcb795f88abe670b270d02c8ad330b9d9cf03263b926877501a","observation_id":"b0e495c8-5b73-49fe-a311-4d8fd5a12a49","resolution":{"observed_at":"2026-08-07T14:44:44.655171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:47.108377Z","title":"Erhan, D., Courville, A., Bengio, Y ., and Vincent, P","venue":null,"work_id":"53563253-7b6f-42c8-821e-39d5147c579d","year":2021},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:42.187163Z"},"links":{"citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:0a2d190a44afe55c007e33f9a676ad8e4b1ca9e169d26f36f03ee8436701b105","observation_id":"3a4bcadf-cc16-4c91-bef6-0cd69aef0a59","resolution":{"observed_at":"2026-08-07T14:44:47.202702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15430","last_updated":"2023-03-07T10:08:04Z","snapshot_observed_at":"2026-08-06T13:05:55.693185Z","submitted_at":"2022-09-30T12:37:03Z","title":"Relative representations enable zero-shot latent space communication","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15430","snapshot_observed_at":"2026-08-07T14:44:42.982828Z","title":"Relative representations enable zero-shot latent space communication.arXiv preprint arXiv:2209.15430,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:42.982828Z"},"links":{"cited_paper":"/paper/2209.15430","citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:4f8edb84bbcbc1af97706a87f81cfb4155db837c3095660d87bb7b4395fd537f","observation_id":"0b6b2d8b-ff9a-4d24-8d73-e38c49e9022e","resolution":{"observed_at":"2026-08-07T14:44:42.982828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T14:44:42.057515Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:42.057515Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:7437e70c207cfba9d5808c3c47422523594aaa51afba14e95dea3be59c65ca78","observation_id":"fea16326-328c-405d-9541-4796f430d6eb","resolution":{"observed_at":"2026-08-07T14:44:42.057515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:47.679782Z","title":"Sparse autoencoders find highly interpretable features in language models.ICLR 2024,","venue":null,"work_id":"ada09065-5a12-4956-a02d-bbea0c390f96","year":2024},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:41.977022Z"},"links":{"citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:c7a046d189546707a99a740b832f3cd0a0b565e34270403d70f019a4bd46801f","observation_id":"59f5debc-0196-472d-bb19-6f0a0cfe9eed","resolution":{"observed_at":"2026-08-07T14:44:47.800969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:46.922972Z","title":"and Manning, C","venue":null,"work_id":"2564e4a0-4913-4c4d-9267-b653962fc953","year":2019},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:42.546163Z"},"links":{"citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:2e9683645425fd12529f3d318de7a5d7f1b9e87071a24c00a9f82e3b0408043b","observation_id":"777e870b-12c5-495c-9393-e10c7463cf43","resolution":{"observed_at":"2026-08-07T14:44:47.000622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:45.379759Z","title":"1 . Field of the Invention \\n The present invention relates to a camera system for transmitting and receiving data to and from a camera by obtaining information /hlon","venue":null,"work_id":"ebe482bf-4a5f-4b0c-b687-da242d2b9aa5","year":1926},"citing_paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models","version":2},"reference_index":7000,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:43.675581Z"},"links":{"citing_paper":"/paper/2505.17769"},"observation_digest":"sha256:d335683ec42d26f80f12fd2e8b1b5faa4a71bcecd5d086695cae7856e27c7928","observation_id":"38989650-1d08-4e50-80f6-328da5afd4ed","resolution":{"observed_at":"2026-08-07T14:44:45.502512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.17769","last_updated":"2025-06-12T11:54:13Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T14:38:57.946096Z","submitted_at":"2025-05-23T11:41:41Z","title":"Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 3 inbound Pith citation observations for arXiv:2505.17769."}