{"as_of":"2026-08-14T21:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:42ec945188de4d70ed7338eac0b8bdc029f092be991c0665be8070ce19cbd2b5","coverage":[{"denominator":98,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":98,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T14:55:02.296395Z","state":"measured"},{"denominator":112,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":112,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:48:35.756321Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T13:45:45.794455Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-08-06T22:48:35.756321Z","title":"Interpretability in parameter space: Minimizing mechanistic description length with attribution-based parameter decomposition, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20790","last_updated":"2025-09-04T11:41:34Z","snapshot_observed_at":"2026-08-14T18:44:49.766181Z","submitted_at":"2025-06-25T19:26:31Z","title":"Stochastic Parameter Decomposition","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T22:48:35.756321Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2506.20790"},"observation_digest":"sha256:d27f84eee70e7ee97281581abb156cce6929b7ee3fa99756d56d7dfff9b60b0c","observation_id":"949792ff-a09c-423b-af8d-70de132f16cb","resolution":{"observed_at":"2026-08-06T22:48:35.756321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-08-06T17:53:54.937410Z","title":"Interpretability in parameter space: Minimizing mechanistic description length with attribution-based parameter decomposition, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09816","last_updated":"2025-07-13T22:18:15Z","snapshot_observed_at":"2026-08-14T20:12:33.770140Z","submitted_at":"2025-07-13T22:18:15Z","title":"Compressed Computation: Dense Circuits in a Toy Model of the Universal-AND Problem","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T17:53:54.937410Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2507.09816"},"observation_digest":"sha256:47b9ad169f2b565a505375998d7da9979103ef7f9bc722979460a487b48ab8d5","observation_id":"9ba45641-6e74-4ebd-b363-e38974e2b928","resolution":{"observed_at":"2026-08-06T17:53:54.937410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-08-05T14:27:25.414379Z","title":"Interpretability in parameter space: Minimizing mechanistic description length with attribution-based parameter decomposition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21324","last_updated":"2025-08-29T04:42:17Z","snapshot_observed_at":"2026-08-09T09:00:42.140024Z","submitted_at":"2025-08-29T04:42:17Z","title":"Distribution-Aware Feature Selection for SAEs","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-05T14:27:25.414379Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2508.21324"},"observation_digest":"sha256:a1aefdaa2e00101b33574690097277e67c1e494dcdfe041921d6a2488c9aec9a","observation_id":"faf94b8e-5da5-4fb6-b848-1c0faa36b836","resolution":{"observed_at":"2026-08-05T14:27:25.414379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":"2501.14926","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-07-01T13:45:45.794455Z","title":"2025 , archivePrefix=","venue":null,"work_id":"c636c722-428c-471d-b0d4-43ba45159958","year":2025},"citing_paper":{"arxiv_id":"2509.06701","last_updated":"2026-05-12T03:07:08Z","snapshot_observed_at":"2026-08-13T16:15:19.884745Z","submitted_at":"2025-09-08T13:55:01Z","title":"Probabilistic Modeling of Latent Agentic Substructures in Deep Neural Networks","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-18T18:25:25.751119Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2509.06701"},"observation_digest":"sha256:1bc51fd4e85022a5b608df3c3b92dff330554db2009f489a7fe978691161af2c","observation_id":"970d5072-366b-40f5-822d-c524a60c0c1e","resolution":{"observed_at":"2026-05-18T18:26:43.729817Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":"2501.14926","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-07-01T13:45:45.794455Z","title":"2025 , archivePrefix=","venue":null,"work_id":"c636c722-428c-471d-b0d4-43ba45159958","year":2025},"citing_paper":{"arxiv_id":"2605.08934","last_updated":"2026-06-16T20:17:16Z","snapshot_observed_at":"2026-08-11T08:05:03.537052Z","submitted_at":"2026-05-09T13:08:07Z","title":"From Mechanistic to Compositional Interpretability","version":1},"reference_index":165,"source":"arxiv_source","source_observed_at":"2026-05-12T02:42:26.173782Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2605.08934"},"observation_digest":"sha256:eeeb6c0641b792ab1bee18a78a51319b72b129174d66c3be050a161883db0c29","observation_id":"97c1011c-aafe-420a-98b0-3c93a5cfaa63","resolution":{"observed_at":"2026-05-12T07:31:25.724304Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":"2501.14926","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-07-01T13:45:45.794455Z","title":"2025 , archivePrefix=","venue":null,"work_id":"c636c722-428c-471d-b0d4-43ba45159958","year":2025},"citing_paper":{"arxiv_id":"2605.08934","last_updated":"2026-06-16T20:17:16Z","snapshot_observed_at":"2026-08-11T08:05:03.537052Z","submitted_at":"2026-05-09T13:08:07Z","title":"From Mechanistic to Compositional Interpretability","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-30T22:50:30.931443Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2605.08934"},"observation_digest":"sha256:a14c967ffb724369c1b14cb08bf241082d94b4c3cd7849b22234ff34c28901b6","observation_id":"d4ce204f-df02-4e4e-905c-993e9ec9ba84","resolution":{"observed_at":"2026-07-01T13:45:45.796059Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":"2501.14926","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-07-01T13:45:45.794455Z","title":"2025 , archivePrefix=","venue":null,"work_id":"c636c722-428c-471d-b0d4-43ba45159958","year":2025},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-05-14T20:53:40.666929Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:4b727551fdb48c6451dab5a1e4441a9c0b1aefa68cf36c9a2a1c8978ea07aa68","observation_id":"0db6320c-f8c7-465e-814b-e2be99bfdfde","resolution":{"observed_at":"2026-05-14T20:59:28.694229Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":"2501.14926","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-07-01T13:45:45.794455Z","title":"2025 , archivePrefix=","venue":null,"work_id":"c636c722-428c-471d-b0d4-43ba45159958","year":2025},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":2},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-05-15T04:59:11.877068Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:ea540238c039006c5693a0e87f59f5277fd26eadfa91043a75a77a69d8dadd06","observation_id":"301edd04-c892-43ea-9e67-1927f76d2a69","resolution":{"observed_at":"2026-05-15T04:59:45.129312Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":"2501.14926","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-07-01T13:45:45.794455Z","title":"2025 , archivePrefix=","venue":null,"work_id":"c636c722-428c-471d-b0d4-43ba45159958","year":2025},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":3},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-05-20T21:49:47.934339Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:62833fc6c5309970fa95806003bcf3a0051503ac1e4d32aa0f9dacf374daf9b3","observation_id":"1fdbf09e-296c-4b81-87df-b3ffdcc8d030","resolution":{"observed_at":"2026-05-20T21:53:47.229223Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":"2501.14926","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-07-01T13:45:45.794455Z","title":"2025 , archivePrefix=","venue":null,"work_id":"c636c722-428c-471d-b0d4-43ba45159958","year":2025},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T07:46:41.159688Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:26dbe67ed2d0a9d4d8ab6cac3e3f496b8814b1119cd71c9425dcd58ef893148b","observation_id":"7ef79c78-70c0-401c-bf1c-8af855b4db2d","resolution":{"observed_at":"2026-05-21T07:49:50.131311Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-07-12T05:48:11.148130Z","title":"Interpretability in parameter space: Minimizing mechanistic description length with attribution-based parameter decomposition.arXiv preprint arXiv:2501.14926,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.02964","last_updated":"2026-07-03T05:15:55Z","snapshot_observed_at":"2026-08-02T17:51:58.348369Z","submitted_at":"2026-07-03T05:15:55Z","title":"Individual Parameters in Weight-Sparse Transformers Appear Interpretable","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-12T05:48:11.148130Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2607.02964"},"observation_digest":"sha256:bcf1275079a3879a8ba539971268633044566c975c6f8e2fe08873c28ae06ba4","observation_id":"be8bee61-c3f9-4374-b900-fbd07da20073","resolution":{"observed_at":"2026-07-12T05:48:11.148130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-07-11T13:19:28.945702Z","title":"Bushnaq, L., Braun, D., and Sharkey, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04800","last_updated":"2026-07-06T08:33:51Z","snapshot_observed_at":"2026-08-12T23:48:32.333779Z","submitted_at":"2026-07-06T08:33:51Z","title":"Compressed Computation under $L^4$ Loss is likely Computation in Superposition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T13:19:28.945702Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2607.04800"},"observation_digest":"sha256:a65f9e3c21cf93efb8f31a51477ec36a50cfa2b6fe5cb4913ecbd577cc4fed73","observation_id":"d27582ca-8c0b-4f9a-b194-fd0664b6eb63","resolution":{"observed_at":"2026-07-11T13:19:28.945702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-08-02T10:39:49.368052Z","title":"Interpretability in","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13047","last_updated":"2026-06-19T19:07:38Z","snapshot_observed_at":"2026-08-10T04:42:58.694391Z","submitted_at":"2026-06-19T19:07:38Z","title":"Targeted Recovery of Weight-Space Mechanisms From Neural Networks","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-02T10:39:49.368052Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2607.13047"},"observation_digest":"sha256:048a674e935fc06dceddd6f2b0320052e7dd9f72635ccc9094050c5bd79fdf3f","observation_id":"8e665692-cb8f-4e65-a9a0-5204335db1d1","resolution":{"observed_at":"2026-08-02T10:39:49.368052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-08-02T10:40:00.727345Z","title":"Interpretability in Parameter Space : Minimizing Mechanistic Description Length with Attribution -based Parameter Decomposition , February 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13047","last_updated":"2026-06-19T19:07:38Z","snapshot_observed_at":"2026-08-10T04:42:58.694391Z","submitted_at":"2026-06-19T19:07:38Z","title":"Targeted Recovery of Weight-Space Mechanisms From Neural Networks","version":1},"reference_index":150,"source":"arxiv_source","source_observed_at":"2026-08-02T10:40:00.727345Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2607.13047"},"observation_digest":"sha256:cd827deeed1c0b1d1123aa1da09cf33da324389012090b9cad2b9e0f95f77c7d","observation_id":"1a523d31-c07d-4b39-8f31-8764ba993132","resolution":{"observed_at":"2026-08-02T10:40:00.727345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.14926/citation-record","integrity":"/paper/2501.14926/integrity","json":"/paper/2501.14926/citation-record.json","paper":"/paper/2501.14926"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.928897Z","title":"Kanwal, Tegan Maharaj, Asja Fischer, Aaron Courville, Yoshua Bengio, and Simon Lacoste-Julien","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.928897Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:76440086af575d2a1c7f8a342217a35688034ec6604dc772842cbb5db31cded7","observation_id":"09b1940d-c108-4a28-8004-fa2c71e34720","resolution":{"observed_at":"2026-08-10T14:55:01.928897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11179","last_updated":"2024-10-15T01:38:03Z","snapshot_observed_at":"2026-08-14T15:05:59.451697Z","submitted_at":"2024-10-15T01:38:03Z","title":"Interpretability as Compression: Reconsidering SAE Explanations of Neural Activations with MDL-SAEs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11179","snapshot_observed_at":"2026-08-10T14:55:01.933680Z","title":"Pearce, and Lee Sharkey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.933680Z"},"links":{"cited_paper":"/paper/2410.11179","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:d295b101cfd0136f94b37ed32a7c646a6414b18b4bcc1e8640385e926d797a29","observation_id":"5ff0f2e1-5552-4681-9d87-e8bca6b4e05e","resolution":{"observed_at":"2026-08-10T14:55:01.933680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12241","last_updated":"2024-05-24T13:16:32Z","snapshot_observed_at":"2026-08-14T04:38:42.916801Z","submitted_at":"2024-05-17T17:03:46Z","title":"Identifying Functionally Important Features with End-to-End Sparse Dictionary Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12241","snapshot_observed_at":"2026-08-10T14:55:01.937875Z","title":"Identifying functionally important features with end-to-end sparse dictionary learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.937875Z"},"links":{"cited_paper":"/paper/2405.12241","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:d99dad2036fae9033fd1b2f5313c98d42e71885efd8f7d37e774ea9f54906ee8","observation_id":"1343e9ed-b73c-47b6-9cb1-6bd36fea3079","resolution":{"observed_at":"2026-08-10T14:55:01.937875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.941999Z","title":"Towards monosemanticity: Decomposing language models with dictionary learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.941999Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:a150ae96c78fd30eda89f017ad20d5c26eb5fad7e3c1540ebc75a05831275eeb","observation_id":"617b012a-0737-4cfb-a035-3ad389d2c153","resolution":{"observed_at":"2026-08-10T14:55:01.941999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.945578Z","title":"Circuits in superposition: Compressing many small neural networks into one, Oct 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.945578Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:e1e45dffb3f7f508951890ab1ebe4c6c6ac5492650e4bc06c56349af45edd68f","observation_id":"17a24b05-cdfe-45f0-a115-ef6429f162a1","resolution":{"observed_at":"2026-08-10T14:55:01.945578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.949426Z","title":"Showing sae latents are not atomic using meta-saes, Aug 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.949426Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:e2dd52b0b4059a2ea6676da6eaa5b779e1bad0577da6f2bb652be842e989d6b6","observation_id":"193ed564-f8a4-4aad-a858-f59e4a85b671","resolution":{"observed_at":"2026-08-10T14:55:01.949426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-10T14:55:01.953347Z","title":"Batchtopk sparse autoencoders, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.953347Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:5445fe1d6a7b43df0a1d98555c772da83e3909b51bab37a6926b3a832974a1af","observation_id":"d30465e6-3b9d-4f7b-bb16-4213df4a7c54","resolution":{"observed_at":"2026-08-10T14:55:01.953347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.23915/distill.00024.003","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.360536Z","title":"Curve detectors","venue":null,"work_id":"cc9c91fb-0a24-476b-98c8-49e6b4e290f1","year":2020},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.956984Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:6c145e1d35f458ba0f1fc410e2f7f9ef0978d60be29b85bd50f33bdc83dad7cb","observation_id":"f9a57fa0-9dce-4478-bfd3-d50e6ce8a2f3","resolution":{"observed_at":"2026-08-10T14:55:02.364185Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.06837","last_updated":"2021-12-13T17:49:16Z","snapshot_observed_at":"2026-08-13T17:16:49.377547Z","submitted_at":"2021-12-13T17:49:16Z","title":"Sparse Interventions in Language Models with Differentiable Masking","version":1},"cited_work":{"arxiv_id":"2112.06837","doi":null,"metadata_source":"pith","pith_arxiv_id":"2112.06837","snapshot_observed_at":"2026-08-10T14:55:03.047781Z","title":"Sparse Interventions in Language Models with Differentiable Masking","venue":"cs.CL","work_id":"11d64e7c-c225-465a-9d50-42fa240a1f93","year":2021},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.960536Z"},"links":{"cited_paper":"/paper/2112.06837","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:3af3e9aa4826adf863208d50e72160277038f02eb1d61980a8b4525aa8567eb5","observation_id":"5a849cf2-d68c-421a-8e7a-34e97ad9fceb","resolution":{"observed_at":"2026-08-10T14:55:03.051866Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.03514","last_updated":"2021-04-08T05:11:21Z","snapshot_observed_at":"2026-08-14T12:47:10.281665Z","submitted_at":"2021-04-08T05:11:21Z","title":"Low-Complexity Probing via Finding Subnetworks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.03514","snapshot_observed_at":"2026-08-10T14:55:01.964739Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.964739Z"},"links":{"cited_paper":"/paper/2104.03514","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:f6cb4a69f8b6619beb5d465ecd129ceb256262b5785e9163a7ab1ce9eebaff68","observation_id":"6219a49f-4d1d-40ad-a3ae-772fa3017154","resolution":{"observed_at":"2026-08-10T14:55:01.964739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.968431Z","title":"Scaling sparse feature circuit finding to gemma 9b, Jan 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.968431Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:1966a2281dabbc114efc15cecc29ee96fec17869f9dff3f02236db104c889d77","observation_id":"dc2834c1-68c5-4f5a-ac30-c087d3e5389c","resolution":{"observed_at":"2026-08-10T14:55:01.968431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.971790Z","title":"Causal scrubbing: a method for rigorously testing interpretability hypotheses [redwood research], December 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.971790Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:03ab3933d06aae0cffd53901a3142a73b04a741ed2e2053fca5272450c3f5423","observation_id":"1f48ec39-8b39-4b38-a953-a1d9e47a4db5","resolution":{"observed_at":"2026-08-10T14:55:01.971790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.975190Z","title":"A is for absorption: Studying feature splitting and absorption in sparse autoencoders, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.975190Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:5f6cb2908fe0e591ced180428764e5682100708914072150847d4e67047c3e35","observation_id":"546cff5e-8947-47fd-934a-e30a42636ba2","resolution":{"observed_at":"2026-08-10T14:55:01.975190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.978532Z","title":"Mechanistic anomaly detection and elk, 11 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.978532Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:1d3152155809e0628ad0c637a4f4ea897dca50e16ccf8d1dcebb1dba9887f8c0","observation_id":"04522526-8efe-485b-a520-813d8c30e6cf","resolution":{"observed_at":"2026-08-10T14:55:01.978532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0095.2007","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.956600Z","title":"Churchland and Krishna V","venue":null,"work_id":"79322821-21f6-42a5-8458-db92eb9380bc","year":2007},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.981840Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:f454497e65a488274827726de0f2b94ff42ca5fd86a69644c6572a909c96b8c8","observation_id":"33eb7777-8d0c-402d-97e8-cc2dcb5d71a1","resolution":{"observed_at":"2026-08-10T14:55:02.961740Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.985118Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.985118Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:86350b0985010bb3cd27e6ee0cc93d72fe699e11297dcb161a426a7e7c8db2b5","observation_id":"9db26d29-d035-4ea8-beff-77c8a4529424","resolution":{"observed_at":"2026-08-10T14:55:01.985118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02066","last_updated":"2021-03-06T17:35:13Z","snapshot_observed_at":"2026-08-07T17:33:52.595773Z","submitted_at":"2020-10-05T15:04:11Z","title":"Are Neural Nets Modular? Inspecting Functional Modularity Through Differentiable Weight Masks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02066","snapshot_observed_at":"2026-08-10T14:55:01.988432Z","title":"Are neural nets modular? inspecting functional modularity through differentiable weight masks, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.988432Z"},"links":{"cited_paper":"/paper/2010.02066","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:29ab300985daff4c34b56c05e763d4e55c6d0779f80f44515654318ac639d9c3","observation_id":"6b099cc3-2232-4000-819f-47c3cd3e1f91","resolution":{"observed_at":"2026-08-10T14:55:01.988432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-11T07:21:14.568175Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-10T14:55:01.992243Z","title":"Sparse autoencoders find highly interpretable features in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.992243Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:17962e5a2a93bbab3dd181bd38042247fcc6d66b47ac33ab07b49f04b93fcc0e","observation_id":"38b58961-102f-43bd-a77d-cbb852b1bd9d","resolution":{"observed_at":"2026-08-10T14:55:01.992243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.02535","last_updated":"2023-12-24T23:11:19Z","snapshot_observed_at":"2026-08-13T15:51:26.424803Z","submitted_at":"2022-09-06T14:36:57Z","title":"Analyzing Transformers in Embedding Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.02535","snapshot_observed_at":"2026-08-10T14:55:01.995894Z","title":"Analyzing transformers in embedding space, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.995894Z"},"links":{"cited_paper":"/paper/2209.02535","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:883516ae095da7bc645ea9849d54f678f5bb7a2264e44c1fe85ed5bc0aa9dcce","observation_id":"a9b78691-305a-4fe5-8d84-79138553c88c","resolution":{"observed_at":"2026-08-10T14:55:01.995894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.999413Z","title":"Attention is not all you need: Pure attention loses rank doubly exponentially with depth, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.999413Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:135ce912695b2d69c548135609a5cceadd065ff3a5113dcfc5f9ccd33b0cce6a","observation_id":"02b195aa-5c63-464e-a5f2-1017fd31ba0a","resolution":{"observed_at":"2026-08-10T14:55:01.999413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-12T23:40:48.506661Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-10T14:55:02.002736Z","title":"Transcoders find interpretable llm feature circuits, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.002736Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:31357c84628df9dd63bdbfed0e52c01160eeea4802c2ee813318a01697d30b68","observation_id":"857d6d2a-c940-435b-af91-f7e7e6bbd5e5","resolution":{"observed_at":"2026-08-10T14:55:02.002736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.006464Z","title":"Toy models of superposition, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.006464Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:e1ffa7d64389dfb5a242c414aee94dd39da9cec8c920c5ae19601519b9ef8ffa","observation_id":"880d3fbb-f6e2-47a6-ae83-63e9266f9aa4","resolution":{"observed_at":"2026-08-10T14:55:02.006464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-08-14T15:17:34.597821Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-10T14:55:02.009949Z","title":"Michaud, Wes Gurnee, and Max Tegmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.009949Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:865296062db9c5155a189ce88393b5e6bc8800bb9d96b10e6551caa19a23b5bf","observation_id":"5874e8a3-6850-4b3d-b82f-6b03d75d2222","resolution":{"observed_at":"2026-08-10T14:55:02.009949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14670","last_updated":"2025-03-25T17:00:02Z","snapshot_observed_at":"2026-08-12T22:19:51.988026Z","submitted_at":"2024-10-18T17:58:53Z","title":"Decomposing The Dark Matter of Sparse Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14670","snapshot_observed_at":"2026-08-10T14:55:02.013757Z","title":"Decomposing the dark matter of sparse autoencoders, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.013757Z"},"links":{"cited_paper":"/paper/2410.14670","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:3080fcd7ba26ae26c0260a9d8270cd7492fa2ee7b530eb3e7f05821472c2d102","observation_id":"012ba044-59ae-4167-98ad-600cc8c965b8","resolution":{"observed_at":"2026-08-10T14:55:02.013757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.01667","last_updated":"2022-09-04T18:00:29Z","snapshot_observed_at":"2026-08-14T11:01:09.094119Z","submitted_at":"2022-09-04T18:00:29Z","title":"A Review of Sparse Expert Models in Deep Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.01667","snapshot_observed_at":"2026-08-10T14:55:02.018437Z","title":"A review of sparse expert models in deep learning, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.018437Z"},"links":{"cited_paper":"/paper/2209.01667","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:d112910521e8b70d1dd6c55b4c76275e5f47898402f7219cd4bebcced9012346","observation_id":"6dff0965-55a0-415e-8a6d-9902d668811e","resolution":{"observed_at":"2026-08-10T14:55:02.018437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.06087","last_updated":"2021-06-22T05:40:01Z","snapshot_observed_at":"2026-08-03T08:43:53.459112Z","submitted_at":"2021-06-10T23:50:51Z","title":"Causal Analysis of Syntactic Agreement Mechanisms in Neural Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.06087","snapshot_observed_at":"2026-08-10T14:55:02.022650Z","title":"Causal analysis of syntactic agreement mechanisms in neural language models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.022650Z"},"links":{"cited_paper":"/paper/2106.06087","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:37b2d001a5025e324d8f4937ad468108177ce8adc0cd5c8345c7f185f173cb73","observation_id":"fecae163-1a60-4bcd-9a43-0c868c0a2d76","resolution":{"observed_at":"2026-08-10T14:55:02.022650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04093","last_updated":"2024-06-06T14:10:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-06T14:10:12Z","title":"Scaling and evaluating sparse autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04093","snapshot_observed_at":"2026-08-10T14:55:02.026867Z","title":"Scaling and evaluating sparse autoencoders, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.026867Z"},"links":{"cited_paper":"/paper/2406.04093","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:bf09228a592f5cd02dc5fb615fcc1133bb7053e1e686a7a3b5c1ccb9bdf03e85","observation_id":"fe569175-70a4-4fd3-a0d0-eadd57c48af5","resolution":{"observed_at":"2026-08-10T14:55:02.026867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.02536","last_updated":"2024-02-21T23:23:18Z","snapshot_observed_at":"2026-08-13T12:32:04.327199Z","submitted_at":"2023-03-05T00:57:49Z","title":"Finding Alignments Between Interpretable Causal Variables and Distributed Neural Representations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.02536","snapshot_observed_at":"2026-08-10T14:55:02.030913Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.030913Z"},"links":{"cited_paper":"/paper/2303.02536","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:95073e910f703e9b474fb51b936e711d9ad846d04f2a7d434f5643ddb13057cc","observation_id":"024c1d07-87f5-4b2e-9bc5-4ecb81d25b8b","resolution":{"observed_at":"2026-08-10T14:55:02.030913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13927","last_updated":"2020-10-26T22:13:59Z","snapshot_observed_at":"2026-08-13T17:22:58.851727Z","submitted_at":"2020-10-26T22:13:59Z","title":"A novel variational form of the Schatten-$p$ quasi-norm","version":1},"cited_work":{"arxiv_id":"2010.13927","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.13927","snapshot_observed_at":"2026-08-10T14:55:02.765725Z","title":"A novel variational form of the Schatten-$p$ quasi-norm","venue":"math.NA","work_id":"6eb30744-5425-4fde-b524-0c0a08dd069c","year":2020},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.035166Z"},"links":{"cited_paper":"/paper/2010.13927","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:1bffe4273fa372f944b11c22186b5b3674816438c5c59b8c9e54a5f3d60ac3b9","observation_id":"07062fd1-bf6e-49ed-897f-9cf7533316fa","resolution":{"observed_at":"2026-08-10T14:55:02.770315Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11779","last_updated":"2024-12-24T07:17:37Z","snapshot_observed_at":"2026-08-14T14:24:22.691608Z","submitted_at":"2024-06-17T17:34:25Z","title":"Compact Proofs of Model Performance via Mechanistic Interpretability","version":14},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11779","snapshot_observed_at":"2026-08-10T14:55:02.039261Z","title":"Compact proofs of model performance via mechanistic interpretability, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.039261Z"},"links":{"cited_paper":"/paper/2406.11779","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:3b29db8c7362a52b4f051a32673df436bbae88c618b0c9149b8fcf29b8ff2ea0","observation_id":"62522e02-b85a-4cec-a10e-70bf871d2e0d","resolution":{"observed_at":"2026-08-10T14:55:02.039261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.043051Z","title":"Superposition, memorization, and double descent, Jan 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.043051Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:59608730a04db848b6a8c46ea0adb4211030c11fe477bb057a2ed2911d20ecaa","observation_id":"59b15c4c-8ebb-45b7-b18a-d67fc4e75293","resolution":{"observed_at":"2026-08-10T14:55:02.043051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.046632Z","title":null,"venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.046632Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:7a10c3b1df3e7bf34b97e9fabb232c4b4429a2536612f129fdc030192c24e652","observation_id":"31d22bdb-6423-4d7c-b551-c7576b6efdd1","resolution":{"observed_at":"2026-08-10T14:55:02.046632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05451","last_updated":"2024-08-10T06:11:48Z","snapshot_observed_at":"2026-08-12T23:05:41.494718Z","submitted_at":"2024-08-10T06:11:48Z","title":"Mathematical Models of Computation in Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05451","snapshot_observed_at":"2026-08-10T14:55:02.050076Z","title":"Mathematical models of computation in superposition, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.050076Z"},"links":{"cited_paper":"/paper/2408.05451","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:0a67f48db8a91e30fe9682dfd7a2c6a368c90ba1c9579dc1b588b41775c49cb8","observation_id":"7b68efe4-0b30-496b-92a4-11f81b2f98d3","resolution":{"observed_at":"2026-08-10T14:55:02.050076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.054098Z","title":"Jacobs, Michael I","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.054098Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:09eaab72a0d7a9b00e58b722a79b1679d9b3b7941437c8c77dbdac724b2baa90","observation_id":"03117473-def8-40a7-9cfa-f4d34cc3d4ac","resolution":{"observed_at":"2026-08-10T14:55:02.054098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.057917Z","title":"Polysemantic attention head in a 4-layer transformer, Nov 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.057917Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:1326c09656793bffa29d126770ea2684e329d19c76f53725a4c1d722683df369","observation_id":"87c78947-4ce7-4a4e-aea2-2cd111d9b2f7","resolution":{"observed_at":"2026-08-10T14:55:02.057917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.061574Z","title":"Attention head superposition, May 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.061574Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:14349a6adf5407a29ba22cac863bea84f81227def629b9cfbba60b1973775a3a","observation_id":"5a127bcf-b2bc-4b05-9636-1238ef28e54a","resolution":{"observed_at":"2026-08-10T14:55:02.061574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.065337Z","title":"Tanh penalty in dictionary learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.065337Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:525d73f57ea3c76513ceb2c44435b57491ed417ee9363c2f2b8e17d09ef3e4ed","observation_id":"a8f4edbc-d8a3-4648-be3c-0f7950c0ea0a","resolution":{"observed_at":"2026-08-10T14:55:02.065337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.069060Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.069060Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:b1e26148ef885cfc204f049d05e19eb1b5439626ab3e21236dec0030f2689edb","observation_id":"000081ae-18c9-4598-aaeb-77de74c9ecdc","resolution":{"observed_at":"2026-08-10T14:55:02.069060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.072574Z","title":"Knechtli, M","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.072574Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:34d8b4f84c32311e4ce99e49d6b876431a4fd6c29df1563596b0fb913cf20e3d","observation_id":"87a9e57e-b220-48c7-8bb7-ef920ac1b907","resolution":{"observed_at":"2026-08-10T14:55:02.072574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-13T04:05:21.084919Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-10T14:55:02.076326Z","title":"Atp*: An efficient and scalable method for localizing llm behaviour to components, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.076326Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:d538fa5fc961514e8ade7287980c73f06e0280af23691e06634876480e1a9a9f","observation_id":"4dc3b048-ff07-46d0-b532-91eb721ae6a2","resolution":{"observed_at":"2026-08-10T14:55:02.076326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.080342Z","title":"Optimal brain damage","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.080342Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:ffcbc40da75454427b901e3a25543304290205a314b802859ef0e5c0e82ca543","observation_id":"ad53358e-91d1-4a49-817a-606c6c58cb78","resolution":{"observed_at":"2026-08-10T14:55:02.080342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.383718Z","title":"Sparse deep belief net model for visual area v2","venue":null,"work_id":"c178b77a-70a1-4dfc-8003-a8982340de91","year":2007},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.084307Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:8802a06e18963f9cb0f4b8377b7462d3d4146ef9fe6f95cf984a916d92c9ba2b","observation_id":"e0ea3d51-4641-423a-9319-c04bd492970c","resolution":{"observed_at":"2026-08-10T14:55:03.387622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.10884","last_updated":"2023-11-06T19:25:02Z","snapshot_observed_at":"2026-08-13T12:58:03.114173Z","submitted_at":"2023-01-26T00:53:11Z","title":"Break It Down: Evidence for Structural Compositionality in Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.10884","snapshot_observed_at":"2026-08-10T14:55:02.087913Z","title":"Lepori, Thomas Serre, and Ellie Pavlick","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.087913Z"},"links":{"cited_paper":"/paper/2301.10884","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:924cc56cc132cf50c43f05f91856234de323dd27c91a2ba5a5feff1f0ffaae58","observation_id":"9de2a273-ae2e-4abd-81fe-c361c33ac11e","resolution":{"observed_at":"2026-08-10T14:55:02.087913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.091682Z","title":"Measuring the intrinsic dimension of objective landscapes, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.091682Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:0f0404dda54fca0c71dbde27e6514401ac311c4de90648fd7bf72902427c810d","observation_id":"9bad77fd-1515-470f-9938-01db5c3824ca","resolution":{"observed_at":"2026-08-10T14:55:02.091682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.07543","last_updated":"2016-02-28T22:04:54Z","snapshot_observed_at":"2026-08-03T16:55:19.885866Z","submitted_at":"2015-11-24T02:31:46Z","title":"Convergent Learning: Do different neural networks learn the same representations?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.07543","snapshot_observed_at":"2026-08-10T14:55:02.095279Z","title":"Convergent learning: Do different neural networks learn the same representations?, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.095279Z"},"links":{"cited_paper":"/paper/1511.07543","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:bf49cffc14af58a392798a3c39ba6fa727285de016813583cea29156e2414162","observation_id":"58ffde52-cb39-4fcc-916f-b7a6e57402ae","resolution":{"observed_at":"2026-08-10T14:55:02.095279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.099277Z","title":"Sparse crosscoders for cross-layer features and model diffing, October 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.099277Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:6cc1ccb6a80536753829b2518c905362730a17062f71f31bd721c2c05ffcebd6","observation_id":"46e32e6c-8df0-499c-8b32-7ac1d82b37a8","resolution":{"observed_at":"2026-08-10T14:55:02.099277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-10T14:55:02.102887Z","title":"Decoupled weight decay regularization, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.102887Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:4bd0cd92f3620626cb242700c5c4eb224574cf1f9e81da2c987caad27049bc7d","observation_id":"845b9c97-f3d6-4de5-8330-3c630df2878b","resolution":{"observed_at":"2026-08-10T14:55:02.102887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.360401Z","title":"Towards principled evaluations of sparse autoencoders for interpretability and control","venue":null,"work_id":"7b824af4-b668-4041-9e82-4e8b539bb491","year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.107015Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:d0b6395e3f58443ea0961d083b3268f6203652745f2c857c23a217b1bde766f2","observation_id":"331cce98-8d87-40f7-aba9-ff24e5432c19","resolution":{"observed_at":"2026-08-10T14:55:03.364189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5663","last_updated":"2014-03-22T17:12:07Z","snapshot_observed_at":"2026-08-01T16:20:01.675800Z","submitted_at":"2013-12-19T17:46:46Z","title":"k-Sparse Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5663","snapshot_observed_at":"2026-08-10T14:55:02.110319Z","title":"K-sparse autoencoders","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.110319Z"},"links":{"cited_paper":"/paper/1312.5663","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:53571ca76b1f76cf449a91120c61c89e2a0578fb3d44302f090991cfc5dd6950","observation_id":"b5d8c57a-bd40-40cb-811f-fe9ad47dd6e4","resolution":{"observed_at":"2026-08-10T14:55:02.110319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19647","last_updated":"2025-03-27T05:44:45Z","snapshot_observed_at":"2026-08-14T07:35:01.333549Z","submitted_at":"2024-03-28T17:56:07Z","title":"Sparse Feature Circuits: Discovering and Editing Interpretable Causal Graphs in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19647","snapshot_observed_at":"2026-08-10T14:55:02.114088Z","title":"Sparse feature circuits: Discovering and editing interpretable causal graphs in language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.114088Z"},"links":{"cited_paper":"/paper/2403.19647","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:e0ab6d83477e1863419e5e220fe8f71ce947ea6d16127c494c0a7aef2f926836","observation_id":"6834a095-b374-4651-9123-b814e92f7d5a","resolution":{"observed_at":"2026-08-10T14:55:02.114088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.347732Z","title":"Gated attention blocks: Preliminary progress toward removing attention head superposition","venue":null,"work_id":"8d9466e1-e1af-445d-a053-c6a648cade08","year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.117834Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:25a9e9c922c40b19123737c8da7b479bb1fd5caa9636fcadcf5600b4b22c059b","observation_id":"b781cdef-b4b0-4eed-9b57-315f6e80de7b","resolution":{"observed_at":"2026-08-10T14:55:03.352088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.336404Z","title":"McClelland and David E","venue":null,"work_id":"d8c37ad8-dcd8-4f56-8c27-db500fcd5c02","year":1985},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.121329Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:294462939f998ba5cfdfeca0ef0e0058fb21dea648458ffef2dbab51c249a622","observation_id":"5fe6a4c4-e882-495b-8f9c-af03bdb5133f","resolution":{"observed_at":"2026-08-10T14:55:03.340242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.324921Z","title":"Singular value representation: A new graph perspective on neural networks","venue":null,"work_id":"180014a9-3107-4d64-a9cc-dd8fb4a7f0f0","year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.124864Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:c47ac170f01a5b290bb863212dfae0e7fd21fa27bd31bb7060f61c9a1fe621aa","observation_id":"03a23172-c94a-442f-a85a-7d6577c07f17","resolution":{"observed_at":"2026-08-10T14:55:03.329072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.313227Z","title":"Sae feature geometry is outside the superposition hypothesis, Sep 2024","venue":null,"work_id":"b2d8a6b6-e58e-475e-9154-07e45f1f6770","year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.128466Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:a4c77d0305854e9c0d169cbdc917451cbada278c8c659710ef9ac1ecb26d4064","observation_id":"a07837f8-5e87-479d-81a6-64996ac5fe4c","resolution":{"observed_at":"2026-08-10T14:55:03.317228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.302402Z","title":"Locating and editing factual associations in gpt, 2023 a","venue":null,"work_id":"433121f6-aabd-43d5-9754-5f38195763c3","year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.132171Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:cd64f8ff3b36ad777d6108c63ef6f2a77913c426b4654af1192f37315952ca43","observation_id":"6287fb88-e5a9-49a1-aa80-5aa1a46dd0bf","resolution":{"observed_at":"2026-08-10T14:55:03.306178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07229","last_updated":"2023-08-01T18:41:52Z","snapshot_observed_at":"2026-08-13T02:17:30.405636Z","submitted_at":"2022-10-13T17:55:53Z","title":"Mass-Editing Memory in a Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07229","snapshot_observed_at":"2026-08-10T14:55:02.135872Z","title":"Mass-editing memory in a transformer, 2023 b","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.135872Z"},"links":{"cited_paper":"/paper/2210.07229","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:855b4c727e2017cf9110af48516e2946b2b962209b23f74592b4e1e1071455b1","observation_id":"c52c97b4-67f4-4fea-8c0c-5bfc2ca0d538","resolution":{"observed_at":"2026-08-10T14:55:02.135872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13506","last_updated":"2024-01-13T23:51:39Z","snapshot_observed_at":"2026-08-13T12:18:11.077630Z","submitted_at":"2023-03-23T17:58:43Z","title":"The Quantization Model of Neural Scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13506","snapshot_observed_at":"2026-08-10T14:55:02.139710Z","title":"Michaud, Ziming Liu, Uzay Girit, and Max Tegmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.139710Z"},"links":{"cited_paper":"/paper/2303.13506","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:36d1c844de04d53b8ba8851a68616b0fb7fcdb473b047a143a106c049021af5d","observation_id":"fadf4aad-8399-4619-8291-20941ad88368","resolution":{"observed_at":"2026-08-10T14:55:02.139710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.291775Z","title":"The singular value decompositions of transformer weight matrices are highly interpretable, Nov 2022","venue":null,"work_id":"4eeca747-c4ab-4a30-bd8c-d05423c9ad32","year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.143844Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:244ec53ac2757dc57861f9eb68a7c1063dea7a4efb64803fdf5c557188cd50c7","observation_id":"8d7914cc-6360-4120-9e4a-3c8e1439aca2","resolution":{"observed_at":"2026-08-10T14:55:03.295667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.06440","last_updated":"2017-06-08T19:53:26Z","snapshot_observed_at":"2026-08-07T07:29:29.524604Z","submitted_at":"2016-11-19T22:48:30Z","title":"Pruning Convolutional Neural Networks for Resource Efficient Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.06440","snapshot_observed_at":"2026-08-10T14:55:02.147411Z","title":"Pruning convolutional neural networks for resource efficient inference, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.147411Z"},"links":{"cited_paper":"/paper/1611.06440","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:c16f5a0d9c863a9dcfcab7f162d9b557011e58e08cfbb7c0156e142901452054","observation_id":"ec4abf73-5a8b-4fc7-8f81-55987805304e","resolution":{"observed_at":"2026-08-10T14:55:02.147411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01434","last_updated":"2025-06-23T09:05:58Z","snapshot_observed_at":"2026-08-13T13:25:34.116595Z","submitted_at":"2024-10-02T11:36:45Z","title":"Circuit Compositions: Exploring Modular Structures in Transformer-Based Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01434","snapshot_observed_at":"2026-08-10T14:55:02.151456Z","title":"Circuit compositions: Exploring modular structures in transformer-based language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.151456Z"},"links":{"cited_paper":"/paper/2410.01434","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:1227254655d4f46ca0cb34eb0c06bb9bdb598c1740cf383e03d9f69aafab918d","observation_id":"e2919f8f-76c8-4477-8c12-77ceb7f69939","resolution":{"observed_at":"2026-08-10T14:55:02.151456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.06959","last_updated":"2018-05-22T09:55:52Z","snapshot_observed_at":"2026-08-14T19:34:48.621508Z","submitted_at":"2018-03-19T14:42:19Z","title":"On the importance of single directions for generalization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.06959","snapshot_observed_at":"2026-08-10T14:55:02.155256Z","title":"Morcos, David G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.155256Z"},"links":{"cited_paper":"/paper/1803.06959","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:1caf972f8f44fbab45cd0e8b4cd6f165120e0119c1bc4d4e3398348fd34d24ab","observation_id":"27b7520c-61e7-4772-bfb8-c3d9745786c0","resolution":{"observed_at":"2026-08-10T14:55:02.155256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.159103Z","title":"Skeletonization: A technique for trimming the fat from a network via relevance assessment","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.159103Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:9d39eabf0e7d46c88d065553a19ad55c5a677754d1c12a195aa0f6d4bffd717e","observation_id":"49ed94da-e321-4735-84ce-ce96e7d4d2e5","resolution":{"observed_at":"2026-08-10T14:55:02.159103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.272594Z","title":"Attribution patching: Activation patching at industrial scale","venue":null,"work_id":"eb820f6f-a2f3-422e-b858-283eb0720e9e","year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.162392Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:67d3d4cd3b8bb4483f050d38494633277bcc5c4e21563a668eaf7afd93086ec9","observation_id":"b98f766f-a2fc-4676-98d8-aeb67bbfcfa1","resolution":{"observed_at":"2026-08-10T14:55:03.276701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.259946Z","title":"Attribution patching: Activation patching at industrial scale","venue":null,"work_id":"7f0fc166-6a57-420c-b8f5-e1c32080fe85","year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.165761Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:e999ced31a2b447f13242d3a4aa391720136fdd6088e031e338045fa519c15eb","observation_id":"1374f3d1-bc6d-48ac-b5ac-7f66034b2934","resolution":{"observed_at":"2026-08-10T14:55:03.264069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1602.03616","last_updated":"2016-05-07T06:30:51Z","snapshot_observed_at":"2026-07-06T04:45:49.467632Z","submitted_at":"2016-02-11T05:10:42Z","title":"Multifaceted Feature Visualization: Uncovering the Different Types of Features Learned By Each Neuron in Deep Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.03616","snapshot_observed_at":"2026-08-10T14:55:02.169387Z","title":"Multifaceted feature visualization: Uncovering the different types of features learned by each neuron in deep neural networks, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.169387Z"},"links":{"cited_paper":"/paper/1602.03616","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:a186168495e3c53d9e3a0093b89a058e566dc2beee5a4b7e00718e3c1ec9fd08","observation_id":"08ade89d-594f-4317-a75f-d3b6ec60a05c","resolution":{"observed_at":"2026-08-10T14:55:02.169387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.248412Z","title":"interpreting gpt: the logit lens, August 2020","venue":null,"work_id":"08bbcf49-145d-4305-9bd1-2aea336d0b22","year":2020},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.175775Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:f62d0106ad523e637bc515a35f33f917146b78f8fbd51e1d28402c6a85eedb87","observation_id":"92a4349c-eb65-456d-800c-8d576feb9b08","resolution":{"observed_at":"2026-08-10T14:55:03.252185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.235317Z","title":"Weight superposition, May 2023","venue":null,"work_id":"06709a9a-8a1f-4a3d-8ed0-dac92490444a","year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.179883Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:8e5d53c65cfe28d7d9ed150d4828fb5e905f458b9a5925cf61dfc306f16d7666","observation_id":"dc7767ef-0762-4056-bc71-29acaebb861d","resolution":{"observed_at":"2026-08-10T14:55:03.239294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.223696Z","title":"The next five hurdles, July 2024 a","venue":null,"work_id":"1b0e2cc2-2712-4109-b785-15f2af52a56b","year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.183450Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:52f4bb485da068622e77462be1611912ea23d8e03dd691294c516b8f0a06942b","observation_id":"3cc897ff-fb3e-4020-826a-5a91854da724","resolution":{"observed_at":"2026-08-10T14:55:03.227224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.212592Z","title":"What is a linear representation? what is a multidimensional feature?, July 2024 b","venue":null,"work_id":"8be63764-db6f-43ed-9549-bf5b614f7756","year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.186839Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:25a2e519848508219b5594efeb6e33e814f5baf0316ac47c3a1bdc654737aeed","observation_id":"6b1383cf-8fec-4f0a-b5e9-0645cc86932a","resolution":{"observed_at":"2026-08-10T14:55:03.216649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.190525Z","title":"An overview of early vision in inceptionv1","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.190525Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:151b89ae5ec366ccf86decc9b85e31b982125a57c30ada4848e9bf6cde4143ef","observation_id":"49546271-21b0-4089-b05c-35f015aa3fda","resolution":{"observed_at":"2026-08-10T14:55:02.190525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.201372Z","title":"Zoom in: An introduction to circuits","venue":null,"work_id":"d3859e2c-99b2-4f4d-954a-5bc0aabc0e4e","year":2020},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.193950Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:d93df46e7e96fa7ae8cebd87baaf78ab0050c72a3c9adf89e5cd4219162a4971","observation_id":"243994dc-b4c8-4faf-afb4-ee8edacceb51","resolution":{"observed_at":"2026-08-10T14:55:03.205141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04139","last_updated":"2025-06-11T07:36:27Z","snapshot_observed_at":"2026-08-12T00:26:00.692458Z","submitted_at":"2024-12-05T13:06:03Z","title":"Monet: Mixture of Monosemantic Experts for Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04139","snapshot_observed_at":"2026-08-10T14:55:02.197434Z","title":"Monet: Mixture of monosemantic experts for transformers, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.197434Z"},"links":{"cited_paper":"/paper/2412.04139","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:627ab4c1f888703d4a5738020895db06008f6afb06c050de6ca14451f952875b","observation_id":"e3e18910-6f01-4337-ad66-3b0d06010f01","resolution":{"observed_at":"2026-08-10T14:55:02.197434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18402","last_updated":"2023-10-27T19:44:41Z","snapshot_observed_at":"2026-08-14T19:59:38.538117Z","submitted_at":"2023-05-28T15:12:32Z","title":"Neural Sculpting: Uncovering hierarchically modular task structure in neural networks through pruning and network analysis","version":3},"cited_work":{"arxiv_id":"2305.18402","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.18402","snapshot_observed_at":"2026-08-10T14:55:02.477356Z","title":"Neural Sculpting: Uncovering hierarchically modular task structure in neural networks through pruning and network analysis","venue":"cs.LG","work_id":"f60aed66-ce69-4183-8787-8c12ff4238a9","year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.201091Z"},"links":{"cited_paper":"/paper/2305.18402","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:2ca7c51099590799cfcb72cd8bc30e06e12bd56f809e50c62e76569cf0c3df13","observation_id":"910a6b16-b162-447d-bd62-2bfe8d388ef1","resolution":{"observed_at":"2026-08-10T14:55:02.481775Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03947","last_updated":"2024-06-06T10:46:51Z","snapshot_observed_at":"2026-08-13T09:55:55.500625Z","submitted_at":"2024-06-06T10:46:51Z","title":"Weight-based Decomposition: A Case for Bilinear MLPs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03947","snapshot_observed_at":"2026-08-10T14:55:02.205020Z","title":"Pearce, Thomas Dooms, and Alice Rigg","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.205020Z"},"links":{"cited_paper":"/paper/2406.03947","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:84581d31bfa015ed4faee11fe6cf19a87776099c1b302472120cadf15e623c94","observation_id":"819e658e-e88e-4ba8-a14c-e9a8c1919376","resolution":{"observed_at":"2026-08-10T14:55:02.205020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08417","last_updated":"2025-06-25T10:36:59Z","snapshot_observed_at":"2026-08-13T04:30:12.163954Z","submitted_at":"2024-10-10T23:22:11Z","title":"Bilinear MLPs enable weight-based mechanistic interpretability","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08417","snapshot_observed_at":"2026-08-10T14:55:02.209060Z","title":"Pearce, Thomas Dooms, Alice Rigg, Jose M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.209060Z"},"links":{"cited_paper":"/paper/2410.08417","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:bd051293db56a8c8c9a1707a9602e1b5dd358859e229d5b37ad7126306e2375a","observation_id":"aac334ca-267f-478c-a708-e23b1d51c23f","resolution":{"observed_at":"2026-08-10T14:55:02.209060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.23915/distill.00024.009","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.334117Z","title":"Weight banding","venue":null,"work_id":"2240dc73-fb0a-4eec-a31b-cbf2cc9ced71","year":2021},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.212950Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:9dbb62e04a1edaeee4034ef9595ec0a5e6763ca453fab80c26d8e2246eeaa69d","observation_id":"2dcc5a60-cc86-4dcf-ad3c-2bf4592674d1","resolution":{"observed_at":"2026-08-10T14:55:02.339107Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.06876","last_updated":"2019-11-15T21:10:50Z","snapshot_observed_at":"2026-08-02T13:21:31.688461Z","submitted_at":"2019-11-15T21:10:50Z","title":"Explanatory Masks for Neural Network Interpretability","version":1},"cited_work":{"arxiv_id":"1911.06876","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.06876","snapshot_observed_at":"2026-08-10T14:55:02.442089Z","title":"Explanatory Masks for Neural Network Interpretability","venue":"cs.LG","work_id":"f42d32a7-8677-4f9e-b889-0917213bef0f","year":2019},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.217085Z"},"links":{"cited_paper":"/paper/1911.06876","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:dbf620b59a8650d1c9a4d34a930993afc0a2ba88f2c9ac39ea2c2448088ca96c","observation_id":"a07a3579-6e7d-4cd3-af3f-134c2ec52a07","resolution":{"observed_at":"2026-08-10T14:55:02.447075Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.190076Z","title":"Rumelhart, Geoffrey E","venue":null,"work_id":"516aded3-84c5-44a2-afb2-ae5e285aae68","year":1986},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.221652Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:b5cffb9c0811d8c4971e5e794a944e6f9d49ad673d4d78bf6c2e6163593de6a8","observation_id":"c023110c-7bee-4db3-87b1-4e64957811c6","resolution":{"observed_at":"2026-08-10T14:55:03.193658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.179023Z","title":"Sparsify: A mechanistic interpretability research agenda, April 2024","venue":null,"work_id":"98c155b1-7258-45e5-8af7-a60c757291c5","year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.225323Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:fe5c3ed6ace1a706dc3b1a8d958f01c9fcf49d45b26cdcf019a3e865b7a5b0fa","observation_id":"f161cfbf-a8a4-484f-b798-e2f72d98a296","resolution":{"observed_at":"2026-08-10T14:55:03.182804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.229021Z","title":"Taking features out of superposition with sparse autoencoders, Dec 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.229021Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:d6023e0dbcf81ab9a16ddeb50183c554990c0da8f35ddc6735bfa9af378a0191","observation_id":"54f09e4d-853f-4c21-b5b3-fe2dba7a60ed","resolution":{"observed_at":"2026-08-10T14:55:02.229021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16496","last_updated":"2025-01-27T20:57:18Z","snapshot_observed_at":"2026-07-06T20:27:04.664873Z","submitted_at":"2025-01-27T20:57:18Z","title":"Open Problems in Mechanistic Interpretability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16496","snapshot_observed_at":"2026-08-10T14:55:02.232925Z","title":"Michaud, Stephen Casper, Max Tegmark, William Saunders, David Bau, Eric Todd, Atticus Geiger, Mor Geva, Jesse Hoogland, Daniel Murfet, and Tom McGrath","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.232925Z"},"links":{"cited_paper":"/paper/2501.16496","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:a5189b262e813ea87ef6334854f10d07dc07544b2984e6ed3866a0cd5b53ebc9","observation_id":"5d1fdc47-bc03-46b5-b430-4f90cb9c1ea1","resolution":{"observed_at":"2026-08-10T14:55:02.232925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.237281Z","title":"Dropout: A simple way to prevent neural networks from overfitting","venue":null,"work_id":null,"year":1929},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.237281Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:a23d454b190723ff51c76033ed34ecca89c63c5e0d7bb0099b9114e5c2d02bde","observation_id":"acf6724a-f502-4933-9f6b-c2fe1490364d","resolution":{"observed_at":"2026-08-10T14:55:02.237281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.240996Z","title":"Axiomatic attribution for deep networks, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.240996Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:1249af7915bbe16ae5ea54adfd79424c56eaf9ef3ae835821e24e2ad8cf64c8c","observation_id":"1a166d52-8cc1-4aed-bea8-89c523f8bfd9","resolution":{"observed_at":"2026-08-10T14:55:02.240996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10348","last_updated":"2023-11-20T11:31:16Z","snapshot_observed_at":"2026-08-13T14:10:00.082810Z","submitted_at":"2023-10-16T12:34:43Z","title":"Attribution Patching Outperforms Automated Circuit Discovery","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10348","snapshot_observed_at":"2026-08-10T14:55:02.244675Z","title":"Attribution patching outperforms automated circuit discovery, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.244675Z"},"links":{"cited_paper":"/paper/2310.10348","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:56d045381f112be87b9ecdc5d0fe1bd237b6b94985d84d39a40ed20fbd6d0f38","observation_id":"365fa9a5-2ec5-48e9-9c2b-8f25d1773552","resolution":{"observed_at":"2026-08-10T14:55:02.244675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.248489Z","title":"true features","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.248489Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:e6bbaf2bf23ec17233edb763cd7bfe06a0bba2e3d2f723be9b41b058067ec397","observation_id":"913a9a47-88bf-4854-96a8-981f6f9d8455","resolution":{"observed_at":"2026-08-10T14:55:02.248489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.143382Z","title":"Toward a mathematical framework for computation in superposition, Jan 2024","venue":null,"work_id":"cfbf7b5c-6e81-4f0c-b2de-f29e7ecdb481","year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.252131Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:ff5b3176e4ece00ec2a7ab70b1b44cf237ff2ca61e26296cbc7de07c1507c833","observation_id":"f8a613b4-c457-4b60-bd29-20ce2b407a8b","resolution":{"observed_at":"2026-08-10T14:55:03.147118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.132114Z","title":"Residual networks behave like ensembles of relatively shallow networks, 2016","venue":null,"work_id":"44e87196-dcb4-42cc-8a0a-0d674e144176","year":2016},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.256033Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:d58d70dbfcc9a658566f173fa8fbc977cb605e22f784355cf9de3bec7cb6659d","observation_id":"2a14ff0d-55de-4ad8-ac87-3dcbb03fbbc5","resolution":{"observed_at":"2026-08-10T14:55:03.135959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.259446Z","title":"Causal mediation analysis for interpreting neural nlp: The case of gender bias, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.259446Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:60d905b41017a537712556ec3696d8cba1a1f9101049f8f16bd0925704ccec87","observation_id":"53b277d9-50c4-4f17-b84a-ae32a49855cd","resolution":{"observed_at":"2026-08-10T14:55:02.259446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.262889Z","title":"Visualizing weights","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.262889Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:b39d3cec1001e06e49b94dc5769fccf31438f5cfdce444c4acccea485d641f15","observation_id":"1c87052b-bbff-461b-857f-87f917c4e241","resolution":{"observed_at":"2026-08-10T14:55:02.262889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02984","last_updated":"2024-10-03T20:51:02Z","snapshot_observed_at":"2026-08-13T10:03:33.123637Z","submitted_at":"2024-10-03T20:51:02Z","title":"Differentiation and Specialization of Attention Heads via the Refined Local Learning Coefficient","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02984","snapshot_observed_at":"2026-08-10T14:55:02.266549Z","title":"Differentiation and specialization of attention heads via the refined local learning coefficient, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.266549Z"},"links":{"cited_paper":"/paper/2410.02984","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:5e377e26f985ce42829ed9e84b9c3a324e3a711807e418805d7d379d5bd7b5c5","observation_id":"bc79648e-9b45-462e-8880-808f654d0a90","resolution":{"observed_at":"2026-08-10T14:55:02.266549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00593","last_updated":"2022-11-01T17:08:44Z","snapshot_observed_at":"2026-08-05T06:04:21.031867Z","submitted_at":"2022-11-01T17:08:44Z","title":"Interpretability in the Wild: a Circuit for Indirect Object Identification in GPT-2 small","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00593","snapshot_observed_at":"2026-08-10T14:55:02.270268Z","title":"Interpretability in the wild: a circuit for indirect object identification in gpt-2 small","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.270268Z"},"links":{"cited_paper":"/paper/2211.00593","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:c1e1c453859de12eec17803b60f2c77a73b5b272368bc15b5f1b9e0d23c632a2","observation_id":"afab162a-b487-4298-9b9a-441122dd8fd5","resolution":{"observed_at":"2026-08-10T14:55:02.270268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.273821Z","title":"Algebraic geometry and statistical learning theory, volume 25","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.273821Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:ec5d6a31f7d3f97a3e3ae751667bd9facefdcfba142ecd3234c62b94293f72b6","observation_id":"c67c9982-effc-4715-8cba-4de6553e2ed8","resolution":{"observed_at":"2026-08-10T14:55:02.273821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.277248Z","title":"Addressing feature suppression in saes, Feb 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.277248Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:c4a54eedc46d0192f8625a69c5596a3e5b67de5000f6343539e073bc7843d25d","observation_id":"5032a9a4-3397-4454-8d39-f6bf04781513","resolution":{"observed_at":"2026-08-10T14:55:02.277248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.101053Z","title":"Decomposing the qk circuit with bilinear sparse dictionary learning, July 2024","venue":null,"work_id":"f60a1e8e-3225-43b6-9751-5c9616515212","year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.280850Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:c3dc8e2a3d016a30039517b863e1a466ec511886fded7179f0eacf4af50e2a32","observation_id":"f0b4bf34-7058-46f3-8ec0-6e6889796caa","resolution":{"observed_at":"2026-08-10T14:55:03.104946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.15949","last_updated":"2023-04-04T06:43:19Z","snapshot_observed_at":"2026-08-14T10:10:17.012207Z","submitted_at":"2021-03-29T20:51:33Z","title":"Transformer visualization via dictionary learning: contextualized embedding as a linear superposition of transformer factors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.15949","snapshot_observed_at":"2026-08-10T14:55:02.284507Z","title":"Transformer visualization via dictionary learning: contextualized embedding as a linear superposition of transformer factors, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.284507Z"},"links":{"cited_paper":"/paper/2103.15949","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:2e6f275fbfe073f85584d882fe9b072e212ba55956a0b31ceca76f8c6072b50d","observation_id":"07644e3b-7f55-436e-bf61-ead212f82cc6","resolution":{"observed_at":"2026-08-10T14:55:02.284507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.03530","last_updated":"2017-02-26T19:36:40Z","snapshot_observed_at":"2026-08-01T16:56:59.989486Z","submitted_at":"2016-11-10T22:02:36Z","title":"Understanding deep learning requires rethinking generalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.03530","snapshot_observed_at":"2026-08-10T14:55:02.288353Z","title":"Understanding deep learning requires rethinking generalization, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.288353Z"},"links":{"cited_paper":"/paper/1611.03530","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:b77accc9e66f33a31a81751397a3d02c59f04476e6ede2c2117e962578e2016f","observation_id":"0d66d4f7-5417-49f3-be64-af18a795f56b","resolution":{"observed_at":"2026-08-10T14:55:02.288353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.02890","last_updated":"2021-06-05T13:19:27Z","snapshot_observed_at":"2026-08-13T19:09:30.126518Z","submitted_at":"2021-06-05T13:19:27Z","title":"Can Subnetwork Structure be the Key to Out-of-Distribution Generalization?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.02890","snapshot_observed_at":"2026-08-10T14:55:02.292272Z","title":"Can subnetwork structure be the key to out-of-distribution generalization?, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.292272Z"},"links":{"cited_paper":"/paper/2106.02890","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:e365f6de7bd03d41df0bc014fda27243c07f62ff1c6946ea6d9f41ce5fc6e579","observation_id":"7ab53c8e-0d78-4977-bd66-0b10c97c2998","resolution":{"observed_at":"2026-08-10T14:55:02.292272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.090460Z","title":"Moefication: Transformer feed-forward layers are mixtures of experts, 2022","venue":null,"work_id":"e2755554-8e0b-41c7-b759-48ba809519ad","year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.296395Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:0fd51b4d5e53ed100f7b58ef2a48b684b563079894638d91032bcf1c703de1d3","observation_id":"66863b85-3a43-49a3-8e0e-ee70125fd2b6","resolution":{"observed_at":"2026-08-10T14:55:03.094226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T20:11:56.886595Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition"},"reference_resolution":{"displayed":98,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":70,"verified_exact":7,"verified_fuzzy":21},"total_outbound_references":98},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 98 of 98 outbound references and 14 inbound Pith citation observations for arXiv:2501.14926."}