{"as_of":"2026-08-07T23:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5a481f76fbc907345f94e607403655ed155e496c8a60f74b6a0ab3f934502fb9","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":23,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:03:00.843301Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-07T14:03:00.843301Z","title":"Sparse autoencoders do not find canonical units of analysis.arXiv preprint arXiv:2502.04878, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20254","last_updated":"2025-05-26T17:31:36Z","snapshot_observed_at":"2026-08-07T13:53:53.632371Z","submitted_at":"2025-05-26T17:31:36Z","title":"Position: Mechanistic Interpretability Should Prioritize Feature Consistency in SAEs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:00.843301Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2505.20254"},"observation_digest":"sha256:e4a59eef26768b8f7f6f24e80231c95ff5a6a78ac4f336dbbd882cf37534fb1b","observation_id":"9472c785-10ea-4cc4-bee1-c5ab6b941e6d","resolution":{"observed_at":"2026-08-07T14:03:00.843301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-06T22:48:37.411622Z","title":"Sparse autoencoders do not find canonical units of analysis, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20790","last_updated":"2025-09-04T11:41:34Z","snapshot_observed_at":"2026-08-06T22:39:30.024053Z","submitted_at":"2025-06-25T19:26:31Z","title":"Stochastic Parameter Decomposition","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T22:48:37.411622Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2506.20790"},"observation_digest":"sha256:f4c31eb67513c2922fdc34f1169c75261e51efc3207066e11b5d8cd1bab4938a","observation_id":"50f4f490-74c5-4fce-b7d5-385ecd300fd4","resolution":{"observed_at":"2026-08-06T22:48:37.411622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-06T16:40:29.030274Z","title":"Guohao Li, Hasan Abed Al Kader Hammoud, Hani Itani, Dmitrii Khizbullin, and Bernard Ghanem","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12990","last_updated":"2025-07-17T10:57:49Z","snapshot_observed_at":"2026-08-06T16:30:59.675261Z","submitted_at":"2025-07-17T10:57:49Z","title":"Teach Old SAEs New Domain Tricks with Boosting","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T16:40:29.030274Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2507.12990"},"observation_digest":"sha256:fcc54df1add1a2af33bcba1c9604fe53975c7730a11244dbf8701141e85ebfc1","observation_id":"158f39e2-2786-4adc-92dc-0e2a90c0ce6f","resolution":{"observed_at":"2026-08-06T16:40:29.030274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":"2502.04878","doi":"10.48550/arxiv.2502.04878","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025 , archivePrefix=","venue":"ArXiv.org","work_id":"0874bbed-5158-4ddd-ab5b-b47713a17812","year":2025},"citing_paper":{"arxiv_id":"2511.01680","last_updated":"2026-07-15T14:09:50Z","snapshot_observed_at":"2026-08-04T00:23:23.110922Z","submitted_at":"2025-11-03T15:42:32Z","title":"Making Interpretable Discoveries from Unstructured Data: A High-Dimensional Multiple Hypothesis Testing Approach","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-18T01:56:50.978054Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2511.01680"},"observation_digest":"sha256:0d7138a00c45136f74206c8f78914938445045e33f5027f76204efcc388c8f1d","observation_id":"899a1934-92c6-408c-95e4-b7e8a9da13b8","resolution":{"observed_at":"2026-05-18T02:00:40.006102Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-04T00:23:28.785151Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis , February 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.01680","last_updated":"2026-07-15T14:09:50Z","snapshot_observed_at":"2026-08-04T00:23:23.110922Z","submitted_at":"2025-11-03T15:42:32Z","title":"Making Interpretable Discoveries from Unstructured Data: A High-Dimensional Multiple Hypothesis Testing Approach","version":4},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T00:23:28.785151Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2511.01680"},"observation_digest":"sha256:8f65c600acd11dac3e64fc2b01d0aa9544f6d7ed480e2feff149ef8ca6377644","observation_id":"f241173c-da4b-4c12-9b56-37ad8c59b6ac","resolution":{"observed_at":"2026-08-04T00:23:28.785151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-03T04:36:01.693349Z","title":"org/CorpusID:235458009","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2602.04718","last_updated":"2026-08-02T10:23:11Z","snapshot_observed_at":"2026-08-07T08:01:34.687412Z","submitted_at":"2026-02-04T16:29:14Z","title":"Superposition Without Interference? Towards Isolated Interventions via Almost Orthogonal Features in Language Models","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-03T04:36:01.693349Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2602.04718"},"observation_digest":"sha256:6d5bcb06c31fcbfec2a64dcfbb29a90d2511c7f46658abc3feb267d14df03d17","observation_id":"fb0f0e78-985c-4cfb-9741-7beb6e1dfbe4","resolution":{"observed_at":"2026-08-03T04:36:01.693349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-04T06:15:55.771792Z","title":"org/CorpusID:235458009","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2602.04718","last_updated":"2026-08-02T10:23:11Z","snapshot_observed_at":"2026-08-07T08:01:34.687412Z","submitted_at":"2026-02-04T16:29:14Z","title":"Superposition Without Interference? Towards Isolated Interventions via Almost Orthogonal Features in Language Models","version":4},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-04T06:15:55.771792Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2602.04718"},"observation_digest":"sha256:710f23264d1885e3597633db5cbba1ad12b95d605e6684e799fc0dcb511b94f5","observation_id":"383309bf-692f-4e12-bf36-4bc3435bf553","resolution":{"observed_at":"2026-08-04T06:15:55.771792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":"2502.04878","doi":"10.48550/arxiv.2502.04878","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025 , archivePrefix=","venue":"ArXiv.org","work_id":"0874bbed-5158-4ddd-ab5b-b47713a17812","year":2025},"citing_paper":{"arxiv_id":"2605.07922","last_updated":"2026-05-11T02:18:14Z","snapshot_observed_at":"2026-07-06T23:20:15.696237Z","submitted_at":"2026-05-08T15:57:37Z","title":"Tree SAE: Learning Hierarchical Feature Structures in Sparse Autoencoders","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:58.543525Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2605.07922"},"observation_digest":"sha256:b578fd59ae0bcca88eff2f6fd73ba785dc8aaaeb3130115326896efd0b5560ab","observation_id":"7048f3de-b19f-4ae9-af2e-5389e9cd3515","resolution":{"observed_at":"2026-05-11T03:15:54.363637Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":"2502.04878","doi":"10.48550/arxiv.2502.04878","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025 , archivePrefix=","venue":"ArXiv.org","work_id":"0874bbed-5158-4ddd-ab5b-b47713a17812","year":2025},"citing_paper":{"arxiv_id":"2605.07922","last_updated":"2026-05-11T02:18:14Z","snapshot_observed_at":"2026-07-06T23:20:15.696237Z","submitted_at":"2026-05-08T15:57:37Z","title":"Tree SAE: Learning Hierarchical Feature Structures in Sparse Autoencoders","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T03:35:50.776347Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2605.07922"},"observation_digest":"sha256:35e3cc95b039b2fb1dd6731a6adbf06b9a43fda87e89e3c762dc6ee493d5ba2c","observation_id":"7f31fb58-494e-45ad-bc04-5f179e4536d7","resolution":{"observed_at":"2026-05-12T07:16:25.329793Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":"2502.04878","doi":"10.48550/arxiv.2502.04878","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025 , archivePrefix=","venue":"ArXiv.org","work_id":"0874bbed-5158-4ddd-ab5b-b47713a17812","year":2025},"citing_paper":{"arxiv_id":"2605.08012","last_updated":"2026-05-08T17:01:55Z","snapshot_observed_at":"2026-07-06T23:20:19.821342Z","submitted_at":"2026-05-08T17:01:55Z","title":"Position: Mechanistic Interpretability Must Disclose Identification Assumptions for Causal Claims","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-11T02:42:47.178342Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2605.08012"},"observation_digest":"sha256:6f596ab39748d8ca9fc5635490b1fbf9bb1b6cf77790ae4f305a864c1124dc42","observation_id":"dab9fcd5-3d2e-4065-85c4-0899531f3624","resolution":{"observed_at":"2026-05-11T02:45:58.161730Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":"2502.04878","doi":"10.48550/arxiv.2502.04878","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025 , archivePrefix=","venue":"ArXiv.org","work_id":"0874bbed-5158-4ddd-ab5b-b47713a17812","year":2025},"citing_paper":{"arxiv_id":"2605.12122","last_updated":"2026-05-12T13:39:07Z","snapshot_observed_at":"2026-08-02T23:25:18.882744Z","submitted_at":"2026-05-12T13:39:07Z","title":"Disentangled Sparse Representations for Concept-Separated Diffusion Unlearning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T05:49:01.617230Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2605.12122"},"observation_digest":"sha256:7b2be67c9015e1ea4d892bde1b739131dc15460c3e326e9284dd96fe3c9060c7","observation_id":"1fecbe30-0288-4573-b4b9-ffb45395717b","resolution":{"observed_at":"2026-05-13T05:52:22.462659Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":"2502.04878","doi":"10.48550/arxiv.2502.04878","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025 , archivePrefix=","venue":"ArXiv.org","work_id":"0874bbed-5158-4ddd-ab5b-b47713a17812","year":2025},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-05-14T20:53:40.666929Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:e19b301b748e9028338f51adcddbf6b1856510a1da9ed351ae2e72ef7d743e38","observation_id":"636848fb-09da-4f38-bd53-68091360e0b3","resolution":{"observed_at":"2026-05-14T20:59:28.784575Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":"2502.04878","doi":"10.48550/arxiv.2502.04878","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025 , archivePrefix=","venue":"ArXiv.org","work_id":"0874bbed-5158-4ddd-ab5b-b47713a17812","year":2025},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":2},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-05-15T04:59:11.877068Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:d6756ecab65d533d59d4246c3596ceb3619c1853532bb57d2d6bc2da60bbed30","observation_id":"ccd7079f-fd64-42cb-adf8-1bdc9e4c1493","resolution":{"observed_at":"2026-05-15T04:59:45.209373Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":"2502.04878","doi":"10.48550/arxiv.2502.04878","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025 , archivePrefix=","venue":"ArXiv.org","work_id":"0874bbed-5158-4ddd-ab5b-b47713a17812","year":2025},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":3},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-05-20T21:49:47.934339Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:e88381266ced057c06f9cd5af8624f5024debfa673318499539587a2802951b9","observation_id":"601d00b0-efa3-4301-95ad-071b3edf7a0b","resolution":{"observed_at":"2026-05-20T21:53:47.190627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":"2502.04878","doi":"10.48550/arxiv.2502.04878","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025 , archivePrefix=","venue":"ArXiv.org","work_id":"0874bbed-5158-4ddd-ab5b-b47713a17812","year":2025},"citing_paper":{"arxiv_id":"2605.12874","last_updated":"2026-05-13T01:41:38Z","snapshot_observed_at":"2026-07-06T23:24:32.412966Z","submitted_at":"2026-05-13T01:41:38Z","title":"Descriptive Collision in Sparse Autoencoder Auto-Interpretability: When One Explanation Describes Many Features","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:38.363693Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2605.12874"},"observation_digest":"sha256:570a963bb2dbc1ab25ab0f166a47a3cdbec3e8c4aa46d4babd9587dc5a6a4fcc","observation_id":"0a3b2eb0-d68d-43ae-a24c-623bd614bbb4","resolution":{"observed_at":"2026-05-14T20:27:58.974178Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":"2502.04878","doi":"10.48550/arxiv.2502.04878","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025 , archivePrefix=","venue":"ArXiv.org","work_id":"0874bbed-5158-4ddd-ab5b-b47713a17812","year":2025},"citing_paper":{"arxiv_id":"2605.28149","last_updated":"2026-08-04T06:19:42Z","snapshot_observed_at":"2026-08-07T23:09:28.260788Z","submitted_at":"2026-05-27T08:31:43Z","title":"Sign-Aware Gated Sparse Autoencoders: Modeling Anticorrelated Features with Bi-Jump-ReLU Activations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T14:16:44.232080Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2605.28149"},"observation_digest":"sha256:8387459a09f8eeee6a610d431737c384bc4d12753c2800a20efad7be4909213f","observation_id":"11339158-52c7-4c72-86ab-7a76859a9cf6","resolution":{"observed_at":"2026-06-29T14:23:30.750358Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-04T05:02:51.330615Z","title":"Sparse autoencoders do not find canonical units of analysis.arXiv preprint arXiv:2502.04878, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.28149","last_updated":"2026-08-04T06:19:42Z","snapshot_observed_at":"2026-08-07T23:09:28.260788Z","submitted_at":"2026-05-27T08:31:43Z","title":"Sign-Aware Gated Sparse Autoencoders: Modeling Anticorrelated Features with Bi-Jump-ReLU Activations","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T05:02:51.330615Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2605.28149"},"observation_digest":"sha256:56c5cd02075a2512628c1543961dfbcb32ef4ee3d3c36719116b8f214f847a21","observation_id":"cd88b479-ee21-454e-8851-c3ec323e2127","resolution":{"observed_at":"2026-08-04T05:02:51.330615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":"2502.04878","doi":"10.48550/arxiv.2502.04878","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025 , archivePrefix=","venue":"ArXiv.org","work_id":"0874bbed-5158-4ddd-ab5b-b47713a17812","year":2025},"citing_paper":{"arxiv_id":"2606.15054","last_updated":"2026-06-29T22:04:02Z","snapshot_observed_at":"2026-08-03T01:16:15.417885Z","submitted_at":"2026-06-13T01:51:05Z","title":"Size Doesn't Matter: Cosine-Scored Sparse Autoencoders","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-01T07:15:16.674714Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2606.15054"},"observation_digest":"sha256:5c65df5beae8ddc9ad29e2f05315513d3e946d4e87b7365213137c2214937b05","observation_id":"69602583-7167-40d1-924a-e5a348149c10","resolution":{"observed_at":"2026-07-01T07:15:29.633755Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":"2502.04878","doi":"10.48550/arxiv.2502.04878","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025 , archivePrefix=","venue":"ArXiv.org","work_id":"0874bbed-5158-4ddd-ab5b-b47713a17812","year":2025},"citing_paper":{"arxiv_id":"2606.20347","last_updated":"2026-06-18T15:15:57Z","snapshot_observed_at":"2026-08-03T19:01:38.303561Z","submitted_at":"2026-06-18T15:15:57Z","title":"Critical Percolation as a Synthetic Data Model for Interpretability","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T17:41:29.317167Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2606.20347"},"observation_digest":"sha256:6c43785eb2d25dea4a7b90120086539aeff73e6bb945ee39f46c27c6bff15086","observation_id":"efad8060-df6f-4968-a4f5-5f023a01cae4","resolution":{"observed_at":"2026-07-04T03:49:29.575560Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":"2502.04878","doi":"10.48550/arxiv.2502.04878","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025 , archivePrefix=","venue":"ArXiv.org","work_id":"0874bbed-5158-4ddd-ab5b-b47713a17812","year":2025},"citing_paper":{"arxiv_id":"2606.22994","last_updated":"2026-06-22T08:12:34Z","snapshot_observed_at":"2026-08-07T09:18:25.424495Z","submitted_at":"2026-06-22T08:12:34Z","title":"Do Sparse Autoencoders Learn Meaningful Concept Hierarchies?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T08:46:48.220801Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2606.22994"},"observation_digest":"sha256:40b31015c3dd227388a44b8ff0cc32a62dbce516eee0b310983fa652366b09ac","observation_id":"cd273a25-47d3-499a-9d18-b24ccc51c51e","resolution":{"observed_at":"2026-07-04T10:29:45.399426Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":"2502.04878","doi":"10.48550/arxiv.2502.04878","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025 , archivePrefix=","venue":"ArXiv.org","work_id":"0874bbed-5158-4ddd-ab5b-b47713a17812","year":2025},"citing_paper":{"arxiv_id":"2606.26396","last_updated":"2026-06-24T21:26:43Z","snapshot_observed_at":"2026-08-02T16:34:16.438122Z","submitted_at":"2026-06-24T21:26:43Z","title":"At the Edge of Understanding: Sparse Autoencoders Trace The Limits of Transformer Generalization","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-26T01:27:39.812228Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2606.26396"},"observation_digest":"sha256:e8093f3bf86adda8241b67ed6b17579797dcae1d0bffbc58e69ff3c4fdcf3418","observation_id":"d75a73d9-4b33-479c-9ca4-50e195db219f","resolution":{"observed_at":"2026-06-26T01:28:50.567880Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":"2502.04878","doi":"10.48550/arxiv.2502.04878","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025 , archivePrefix=","venue":"ArXiv.org","work_id":"0874bbed-5158-4ddd-ab5b-b47713a17812","year":2025},"citing_paper":{"arxiv_id":"2606.32008","last_updated":"2026-06-30T17:43:44Z","snapshot_observed_at":"2026-08-06T22:13:58.043830Z","submitted_at":"2026-06-30T17:43:44Z","title":"Surrogate Fidelity: When Can Open LLMs Explain Closed Ones?","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-07-01T06:15:42.011563Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2606.32008"},"observation_digest":"sha256:c0c89c5ee79dd2d5b5762e99adeffb91629ec15fd0515dd74e4e40bcf7706bec","observation_id":"51ddf6ad-60a4-4f2e-8637-86b23e9d3cc2","resolution":{"observed_at":"2026-07-01T09:45:40.082546Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04878","snapshot_observed_at":"2026-08-01T23:15:28.686940Z","title":"Sparse autoencoders do not find canonical units of analysis.arXiv preprint arXiv:2502.04878, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15495","last_updated":"2026-07-16T22:54:30Z","snapshot_observed_at":"2026-08-07T08:22:43.917790Z","submitted_at":"2026-07-16T22:54:30Z","title":"Verbalizable Representations Form a Global Workspace in Language Models","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-01T23:15:28.686940Z"},"links":{"cited_paper":"/paper/2502.04878","citing_paper":"/paper/2607.15495"},"observation_digest":"sha256:5f378523e62268b93b450e28948954fb70734e15b926621aa05636b76edba643","observation_id":"322759d2-a828-403a-89b9-196fa3ae6ba1","resolution":{"observed_at":"2026-08-01T23:15:28.686940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.04878/citation-record","integrity":"/paper/2502.04878/integrity","json":"/paper/2502.04878/citation-record.json","paper":"/paper/2502.04878"},"outbound":[],"paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T20:32:48.089559Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 23 inbound Pith citation observations for arXiv:2502.04878."}