{"as_of":"2026-08-08T21:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:07c350e685a193c97faeb3d4de88ee8c4cd1f163edcc62436673c540952cd155","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T21:12:13.839743Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T14:48:32.542751Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.17759","last_updated":"2024-06-25T17:43:13Z","snapshot_observed_at":"2026-08-07T12:13:26.335194Z","submitted_at":"2024-06-25T17:43:13Z","title":"Interpreting Attention Layer Outputs with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17759","snapshot_observed_at":"2026-08-08T21:12:13.839743Z","title":"In- terpreting attention layer outputs with sparse autoencoders","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-08-08T21:04:57.255642Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:13.839743Z"},"links":{"cited_paper":"/paper/2406.17759","citing_paper":"/paper/2502.04878"},"observation_digest":"sha256:a0bb8553a0853aa6c310811859b92478aca5ff438458e9ddf965b8ebc3f093ce","observation_id":"3f60d5c5-bb85-431f-a961-bef702da7580","resolution":{"observed_at":"2026-08-08T21:12:13.839743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17759","last_updated":"2024-06-25T17:43:13Z","snapshot_observed_at":"2026-08-07T12:13:26.335194Z","submitted_at":"2024-06-25T17:43:13Z","title":"Interpreting Attention Layer Outputs with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17759","snapshot_observed_at":"2026-08-07T13:11:10.460312Z","title":"Interpreting attention layer outputs with sparse autoencoders,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22506","last_updated":"2025-05-28T15:54:33Z","snapshot_observed_at":"2026-08-07T13:03:14.367525Z","submitted_at":"2025-05-28T15:54:33Z","title":"Sparsification and Reconstruction from the Perspective of Representation Geometry","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:10.460312Z"},"links":{"cited_paper":"/paper/2406.17759","citing_paper":"/paper/2505.22506"},"observation_digest":"sha256:a08402e9eb799778c2d87e2e29f198befdaee84fb168a8ad65e78ba7559c5e47","observation_id":"efd36319-e7ef-429f-a342-580829d6bd37","resolution":{"observed_at":"2026-08-07T13:11:10.460312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17759","last_updated":"2024-06-25T17:43:13Z","snapshot_observed_at":"2026-08-07T12:13:26.335194Z","submitted_at":"2024-06-25T17:43:13Z","title":"Interpreting Attention Layer Outputs with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17759","snapshot_observed_at":"2026-08-05T12:12:58.685588Z","title":"Interpreting Attention Layer Outputs with Sparse Autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01874","last_updated":"2025-09-02T01:42:39Z","snapshot_observed_at":"2026-08-07T23:12:17.535568Z","submitted_at":"2025-09-02T01:42:39Z","title":"Preserving Bilinear Weight Spectra with a Signed and Shrunk Quadratic Activation Function","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T12:12:58.685588Z"},"links":{"cited_paper":"/paper/2406.17759","citing_paper":"/paper/2509.01874"},"observation_digest":"sha256:5146d8758c0842e961ba2e65135ca5a697c59db9b2a38646e26c2a5c00e21754","observation_id":"008afaf1-7a22-46c6-99bf-91b873aba1aa","resolution":{"observed_at":"2026-08-05T12:12:58.685588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17759","last_updated":"2024-06-25T17:43:13Z","snapshot_observed_at":"2026-08-07T12:13:26.335194Z","submitted_at":"2024-06-25T17:43:13Z","title":"Interpreting Attention Layer Outputs with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17759","snapshot_observed_at":"2026-08-03T00:02:44.553873Z","title":"In- terpreting attention layer outputs with sparse autoencoders.arXiv preprint arXiv:2406.17759,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11852","last_updated":"2026-06-01T12:42:45Z","snapshot_observed_at":"2026-08-06T05:23:58.271327Z","submitted_at":"2026-02-12T11:43:39Z","title":"Prototype Transformer: Towards Language Model Architectures Interpretable by Design","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T00:02:44.553873Z"},"links":{"cited_paper":"/paper/2406.17759","citing_paper":"/paper/2602.11852"},"observation_digest":"sha256:3157d2b9a03b702c1629afd3f3a19a5f476e033247cfeb959f18215eaeb420e8","observation_id":"bfe80cb7-8e10-468a-9df2-844fa94f8921","resolution":{"observed_at":"2026-08-03T00:02:44.553873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17759","last_updated":"2024-06-25T17:43:13Z","snapshot_observed_at":"2026-08-07T12:13:26.335194Z","submitted_at":"2024-06-25T17:43:13Z","title":"Interpreting Attention Layer Outputs with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2406.17759","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.17759","snapshot_observed_at":"2026-07-03T14:48:32.542751Z","title":"arXiv preprint arXiv:2406.17759 , year=","venue":null,"work_id":"0d77d1a3-5b0c-4c4c-a204-6c53cd1470ee","year":2024},"citing_paper":{"arxiv_id":"2604.20467","last_updated":"2026-04-22T11:54:09Z","snapshot_observed_at":"2026-08-02T08:56:24.024385Z","submitted_at":"2026-04-22T11:54:09Z","title":"Mechanistic Interpretability Tool for AI Weather Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-09T23:03:10.147939Z"},"links":{"cited_paper":"/paper/2406.17759","citing_paper":"/paper/2604.20467"},"observation_digest":"sha256:129a71239a3186d2167a2b976fef84050a0a040444c5511860f9948cc15f75cf","observation_id":"0a75fdac-17f9-4a8b-9600-658d17256cd1","resolution":{"observed_at":"2026-05-09T23:04:17.540630Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17759","last_updated":"2024-06-25T17:43:13Z","snapshot_observed_at":"2026-08-07T12:13:26.335194Z","submitted_at":"2024-06-25T17:43:13Z","title":"Interpreting Attention Layer Outputs with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2406.17759","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.17759","snapshot_observed_at":"2026-07-03T14:48:32.542751Z","title":"arXiv preprint arXiv:2406.17759 , year=","venue":null,"work_id":"0d77d1a3-5b0c-4c4c-a204-6c53cd1470ee","year":2024},"citing_paper":{"arxiv_id":"2605.02640","last_updated":"2026-06-01T13:27:17Z","snapshot_observed_at":"2026-08-02T21:03:24.601020Z","submitted_at":"2026-05-04T14:26:28Z","title":"Trustworthy AI Suffers from Invariance Conflicts and Causality is The Solution","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-01T00:12:46.618473Z"},"links":{"cited_paper":"/paper/2406.17759","citing_paper":"/paper/2605.02640"},"observation_digest":"sha256:8bd00f06d92b429efa7be011109b933b9d2209edd5c6fb6b34b6e21ef4fd5e21","observation_id":"740999f7-c832-4982-acae-deb464498da8","resolution":{"observed_at":"2026-07-01T00:15:09.110251Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17759","last_updated":"2024-06-25T17:43:13Z","snapshot_observed_at":"2026-08-07T12:13:26.335194Z","submitted_at":"2024-06-25T17:43:13Z","title":"Interpreting Attention Layer Outputs with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2406.17759","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.17759","snapshot_observed_at":"2026-07-03T14:48:32.542751Z","title":"arXiv preprint arXiv:2406.17759 , year=","venue":null,"work_id":"0d77d1a3-5b0c-4c4c-a204-6c53cd1470ee","year":2024},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-14T20:53:40.666929Z"},"links":{"cited_paper":"/paper/2406.17759","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:a4f17d0740a337a95ecb29664e7f453617d3044c018f4d70744f2cba28f70acc","observation_id":"9bd189a0-3194-4232-ab78-265d863a50d8","resolution":{"observed_at":"2026-05-14T20:59:28.745432Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17759","last_updated":"2024-06-25T17:43:13Z","snapshot_observed_at":"2026-08-07T12:13:26.335194Z","submitted_at":"2024-06-25T17:43:13Z","title":"Interpreting Attention Layer Outputs with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2406.17759","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.17759","snapshot_observed_at":"2026-07-03T14:48:32.542751Z","title":"arXiv preprint arXiv:2406.17759 , year=","venue":null,"work_id":"0d77d1a3-5b0c-4c4c-a204-6c53cd1470ee","year":2024},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-15T04:59:11.877068Z"},"links":{"cited_paper":"/paper/2406.17759","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:abc7e08c29746416e2413c009c42fb08d575b6d5c44b2b000756b39c0ac657ab","observation_id":"76114ad5-7bc1-43ca-a070-8aeb2d7f8081","resolution":{"observed_at":"2026-05-15T04:59:45.242840Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17759","last_updated":"2024-06-25T17:43:13Z","snapshot_observed_at":"2026-08-07T12:13:26.335194Z","submitted_at":"2024-06-25T17:43:13Z","title":"Interpreting Attention Layer Outputs with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2406.17759","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.17759","snapshot_observed_at":"2026-07-03T14:48:32.542751Z","title":"arXiv preprint arXiv:2406.17759 , year=","venue":null,"work_id":"0d77d1a3-5b0c-4c4c-a204-6c53cd1470ee","year":2024},"citing_paper":{"arxiv_id":"2607.02494","last_updated":"2026-07-02T17:55:24Z","snapshot_observed_at":"2026-08-03T14:52:50.505098Z","submitted_at":"2026-07-02T17:55:24Z","title":"Towards Robustness against Typographic Attack with Training-free Concept Localization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-03T14:41:21.582578Z"},"links":{"cited_paper":"/paper/2406.17759","citing_paper":"/paper/2607.02494"},"observation_digest":"sha256:0dbd90fcad2dcbb62c6d49891ecf06f9fabc7c958cfb146e811329dfd9d097a7","observation_id":"0d1d14fc-7fd4-4c20-8fac-9f0c903630cc","resolution":{"observed_at":"2026-07-03T14:48:32.544178Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17759","last_updated":"2024-06-25T17:43:13Z","snapshot_observed_at":"2026-08-07T12:13:26.335194Z","submitted_at":"2024-06-25T17:43:13Z","title":"Interpreting Attention Layer Outputs with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17759","snapshot_observed_at":"2026-07-11T20:06:55.102341Z","title":"Interpreting attention layer outputs with sparse autoencoders.arXiv preprint arXiv:2406.17759,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04319","last_updated":"2026-07-05T14:08:59Z","snapshot_observed_at":"2026-08-06T22:32:49.321254Z","submitted_at":"2026-07-05T14:08:59Z","title":"Legible-by-Construction: Attention and End-to-End Transformers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T20:06:55.102341Z"},"links":{"cited_paper":"/paper/2406.17759","citing_paper":"/paper/2607.04319"},"observation_digest":"sha256:411718d56e29bbc641f64fd2aa0efe4d6bc0e214e94010cb4db9f8913e0e6b77","observation_id":"87555c08-0e83-4cf0-ae23-cde7b5a07b5a","resolution":{"observed_at":"2026-07-11T20:06:55.102341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.17759/citation-record","integrity":"/paper/2406.17759/integrity","json":"/paper/2406.17759/citation-record.json","paper":"/paper/2406.17759"},"outbound":[],"paper":{"arxiv_id":"2406.17759","last_updated":"2024-06-25T17:43:13Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T12:13:26.335194Z","submitted_at":"2024-06-25T17:43:13Z","title":"Interpreting Attention Layer Outputs with Sparse Autoencoders"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2406.17759."}