{"as_of":"2026-08-17T17:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cd875c2fbeb635e3c2d20e3e1ca8e0c166e6bac2007b2e50e31f00465807dc8f","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:41:17.984961Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T08:39:14.327838Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"cited_work":{"arxiv_id":"2509.02565","doi":"10.48550/arxiv.2509.02565","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.02565","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"J., Gorton, L., and McGrath, T","venue":"arXiv (Cornell University)","work_id":"73792b28-6a45-4abc-8df5-096a76b42af3","year":2025},"citing_paper":{"arxiv_id":"2605.01192","last_updated":"2026-05-02T02:11:31Z","snapshot_observed_at":"2026-08-17T10:58:43.390497Z","submitted_at":"2026-05-02T02:11:31Z","title":"Linear-Readout Floors and Threshold Recovery in Computation in Superposition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-09T14:20:04.839150Z"},"links":{"cited_paper":"/paper/2509.02565","citing_paper":"/paper/2605.01192"},"observation_digest":"sha256:8312954ad53b8832c4c824cc33df98dfc330649c4e459a75e3a61ee716d4d23c","observation_id":"f5efb220-453d-48ba-8e49-7567a34a87ae","resolution":{"observed_at":"2026-05-11T17:01:06.053883Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"cited_work":{"arxiv_id":"2509.02565","doi":"10.48550/arxiv.2509.02565","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.02565","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"J., Gorton, L., and McGrath, T","venue":"arXiv (Cornell University)","work_id":"73792b28-6a45-4abc-8df5-096a76b42af3","year":2025},"citing_paper":{"arxiv_id":"2605.29548","last_updated":"2026-06-01T17:29:35Z","snapshot_observed_at":"2026-08-16T11:18:57.974744Z","submitted_at":"2026-05-28T08:02:11Z","title":"Why Larger Models Learn More: Effects of Capacity, Interference, and Rare-Task Retention","version":2},"reference_index":137,"source":"pdf_text","source_observed_at":"2026-06-29T08:39:14.327838Z"},"links":{"cited_paper":"/paper/2509.02565","citing_paper":"/paper/2605.29548"},"observation_digest":"sha256:7c542eae90833181893e367e76de0c5b3bd4c4abf320483e09fe4df46e7559f4","observation_id":"270c6609-5820-4cd9-b09c-fbd89de2caf7","resolution":{"observed_at":"2026-06-29T08:43:15.189013Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"cited_work":{"arxiv_id":"2509.02565","doi":"10.48550/arxiv.2509.02565","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.02565","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"J., Gorton, L., and McGrath, T","venue":"arXiv (Cornell University)","work_id":"73792b28-6a45-4abc-8df5-096a76b42af3","year":2025},"citing_paper":{"arxiv_id":"2606.06333","last_updated":"2026-06-04T16:08:25Z","snapshot_observed_at":"2026-08-02T07:30:20.394633Z","submitted_at":"2026-06-04T16:08:25Z","title":"Subspace-Aware Sparse Autoencoders for Effective Mechanistic Interpretability","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-28T02:07:18.198225Z"},"links":{"cited_paper":"/paper/2509.02565","citing_paper":"/paper/2606.06333"},"observation_digest":"sha256:9bf87f9f62ed74f8c425df86f3831df745b52ab58abdb8c3b35bc5cb8fa80b10","observation_id":"1689f233-0a41-4144-970c-f07f5f3ac96b","resolution":{"observed_at":"2026-06-28T02:11:29.096042Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"cited_work":{"arxiv_id":"2509.02565","doi":"10.48550/arxiv.2509.02565","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.02565","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"J., Gorton, L., and McGrath, T","venue":"arXiv (Cornell University)","work_id":"73792b28-6a45-4abc-8df5-096a76b42af3","year":2025},"citing_paper":{"arxiv_id":"2606.07007","last_updated":"2026-06-05T07:52:43Z","snapshot_observed_at":"2026-08-12T17:17:53.375832Z","submitted_at":"2026-06-05T07:52:43Z","title":"A Geometric View for Understanding Concept Learning and Neuron Interpretation in Sparse Autoencoders","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-27T22:22:50.474397Z"},"links":{"cited_paper":"/paper/2509.02565","citing_paper":"/paper/2606.07007"},"observation_digest":"sha256:6f86f0c571922c68e096e5ddcb1470714300baac02d2a0d1ec10931539b1a02e","observation_id":"bf416963-e3f6-47fc-96b1-b4a64b1ea4f7","resolution":{"observed_at":"2026-07-02T16:47:09.908843Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"cited_work":{"arxiv_id":"2509.02565","doi":"10.48550/arxiv.2509.02565","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.02565","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"J., Gorton, L., and McGrath, T","venue":"arXiv (Cornell University)","work_id":"73792b28-6a45-4abc-8df5-096a76b42af3","year":2025},"citing_paper":{"arxiv_id":"2606.20347","last_updated":"2026-06-18T15:15:57Z","snapshot_observed_at":"2026-08-14T03:12:45.990611Z","submitted_at":"2026-06-18T15:15:57Z","title":"Critical Percolation as a Synthetic Data Model for Interpretability","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T17:41:29.317167Z"},"links":{"cited_paper":"/paper/2509.02565","citing_paper":"/paper/2606.20347"},"observation_digest":"sha256:26a3b9a9597bb476e95a3e90b38fa6d2e6f4a52877364f9e2803ca2a4b76629c","observation_id":"a197f7e4-ae30-41d6-968b-d9bb127aa08b","resolution":{"observed_at":"2026-07-04T03:49:29.547821Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.02565/citation-record","integrity":"/paper/2509.02565/integrity","json":"/paper/2509.02565/citation-record.json","paper":"/paper/2509.02565"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:17.828845Z","title":"Sparse autoencoder","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.828845Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:169a13ff48c94a51dbd4e437d21efe2d7558bf502f41cf9c98c81f2f78c251ed","observation_id":"3af68547-824a-4abb-b3f6-7766a5492011","resolution":{"observed_at":"2026-08-15T16:41:17.828845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-16T13:37:26.527260Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-15T16:41:17.833953Z","title":"Sparse autoen- coders find highly interpretable features in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.833953Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:b639bd703121b37848b215ad39bb6d85ae499978933bd785d126740abbac4390","observation_id":"5e5361c4-61b9-4b93-8347-2a76ad88b0f2","resolution":{"observed_at":"2026-08-15T16:41:17.833953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:17.839335Z","title":"Towards monosemanticity: Decomposing language models with dictionary learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.839335Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:22256e3f100cf14ebb7977e0082517b976e85b990a5e5445940cf7eed03ce2bf","observation_id":"5fe99f32-cb02-4921-8e66-a82f616ba957","resolution":{"observed_at":"2026-08-15T16:41:17.839335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04093","last_updated":"2024-06-06T14:10:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-06T14:10:12Z","title":"Scaling and evaluating sparse autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04093","snapshot_observed_at":"2026-08-15T16:41:17.844028Z","title":"Scaling and evaluating sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.844028Z"},"links":{"cited_paper":"/paper/2406.04093","citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:a482946e5d178adc18a69b817e0bbb1d07e09989dedd442bae922af7807f6287","observation_id":"697a7e59-c499-4f95-868b-b0226efde245","resolution":{"observed_at":"2026-08-15T16:41:17.844028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14435","last_updated":"2024-08-01T17:42:04Z","snapshot_observed_at":"2026-08-08T18:10:15.134088Z","submitted_at":"2024-07-19T16:07:19Z","title":"Jumping Ahead: Improving Reconstruction Fidelity with JumpReLU Sparse Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14435","snapshot_observed_at":"2026-08-15T16:41:17.848897Z","title":"Jumping ahead: Improving reconstruction fidelity with jumprelu sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.848897Z"},"links":{"cited_paper":"/paper/2407.14435","citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:3eec1046d004e3e7bf538e57eed773e21c9477d53ce4500716116b08d63566fe","observation_id":"24cd8b4c-fbaa-4b83-9247-c80e055e33a3","resolution":{"observed_at":"2026-08-15T16:41:17.848897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-16T14:09:13.808921Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-15T16:41:17.853417Z","title":"Batchtopk sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.853417Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:188fc935c878d92f826aa6512ab27c88ed2f0039a763c744345dd1d5d118a3fd","observation_id":"eaebf6d6-4c18-4218-82e9-b0cae5124e14","resolution":{"observed_at":"2026-08-15T16:41:17.853417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12892","last_updated":"2025-05-23T18:07:04Z","snapshot_observed_at":"2026-08-16T14:11:51.022171Z","submitted_at":"2025-02-18T14:29:11Z","title":"Archetypal SAE: Adaptive and Stable Dictionary Learning for Concept Extraction in Large Vision Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12892","snapshot_observed_at":"2026-08-15T16:41:17.858258Z","title":"Archetypal sae: Adaptive and stable dictionary learning for concept extraction in large vision models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.858258Z"},"links":{"cited_paper":"/paper/2502.12892","citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:322ce3ad62e61f89af7982b2dbdee79276471ba38f845a561d685a4bd6cc4dd3","observation_id":"620a6511-9548-4b76-b5be-3f92e8d0ed9b","resolution":{"observed_at":"2026-08-15T16:41:17.858258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01197","last_updated":"2025-06-01T22:20:07Z","snapshot_observed_at":"2026-08-17T14:51:42.614986Z","submitted_at":"2025-06-01T22:20:07Z","title":"Incorporating Hierarchical Semantics in Sparse Autoencoder Architectures","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01197","snapshot_observed_at":"2026-08-15T16:41:17.862490Z","title":"Incorporating hierarchical semantics in sparse autoencoder architectures","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.862490Z"},"links":{"cited_paper":"/paper/2506.01197","citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:07cc33574f1e1338746c69852dfce9bc59b6438df0e31911734e41e064cb3467","observation_id":"696e63e5-4a6c-416b-8975-eb223f8695bd","resolution":{"observed_at":"2026-08-15T16:41:17.862490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:17.867229Z","title":"From flat to hierarchical: Extracting sparse representations with matching pursuit","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.867229Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:f5a611dd4eede37f02445064a46ebea52ee02f21c7b5959daa4a912e756d1457","observation_id":"b023f786-c1c2-4578-b66e-aec9bd9dacc7","resolution":{"observed_at":"2026-08-15T16:41:17.867229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:18.773784Z","title":"Transcoders find interpretable llm feature circuits","venue":null,"work_id":"0d193b78-e91f-4374-8867-8ab63eaafb1d","year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.871714Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:6f2473c41780b9757dd69d9d29ba9cdb1aecf0c8fb773022048766eddb8cfc7f","observation_id":"ff8f7b78-007a-47b6-85d2-7ee6f6e2004a","resolution":{"observed_at":"2026-08-15T16:41:18.779100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:18.758035Z","title":"Sparse crosscoders for cross-layer features and model diffing, October 2024","venue":null,"work_id":"ade09bbe-94af-45c3-8963-5d5f3879a0d9","year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.876235Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:f8942f486deebe7ed6fb542406f61b54688d60c129642edff0024df2587a6823","observation_id":"98e4c637-62f6-42e7-8711-f5116838e124","resolution":{"observed_at":"2026-08-15T16:41:18.763155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24184","last_updated":"2024-11-01T03:29:29Z","snapshot_observed_at":"2026-08-16T13:04:03.008857Z","submitted_at":"2024-10-31T17:47:01Z","title":"Group Crosscoders for Mechanistic Analysis of Symmetry","version":2},"cited_work":{"arxiv_id":"2410.24184","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.24184","snapshot_observed_at":"2026-08-15T16:41:18.416860Z","title":"Group Crosscoders for Mechanistic Analysis of Symmetry","venue":"cs.LG","work_id":"8c70ccbf-a6cb-406f-9055-746d4a98b95c","year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.880606Z"},"links":{"cited_paper":"/paper/2410.24184","citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:3cf8d5370d510212a24e034ed60ef1ab510d51259f7da3ed96aed9b25a009978","observation_id":"14d75827-d352-4838-8d41-c3401f5c31cf","resolution":{"observed_at":"2026-08-15T16:41:18.423577Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:17.885499Z","title":"Robustly identifying concepts introduced during chat fine-tuning using crosscoders","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.885499Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:2a4c484a58c3a2f0ddb4f043664c0f6ea67ea2dd0d6115b4da27a338899a8649","observation_id":"e55c8d20-2d29-4f58-9720-c10f389d7bee","resolution":{"observed_at":"2026-08-15T16:41:17.885499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:17.889860Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.889860Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:095dc9d04bbe41edce728b2ce7094d858e4cae7418137119645c799396198924","observation_id":"88caa5b9-b445-4bd9-8169-f5e6092e952b","resolution":{"observed_at":"2026-08-15T16:41:17.889860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:17.894338Z","title":"Daniel Freeman, Theodore R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.894338Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:3f1789646548dba02f34aa289e845fcc1a0c405a093a66f6679e81d613292052","observation_id":"6b001bb1-3f2a-4bc7-9116-755eb49c5cef","resolution":{"observed_at":"2026-08-15T16:41:17.894338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05147","last_updated":"2024-08-19T07:51:05Z","snapshot_observed_at":"2026-08-15T15:50:24.074149Z","submitted_at":"2024-08-09T16:06:42Z","title":"Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05147","snapshot_observed_at":"2026-08-15T16:41:17.898987Z","title":"Gemma scope: Open sparse autoencoders everywhere all at once on gemma 2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.898987Z"},"links":{"cited_paper":"/paper/2408.05147","citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:18eeb87164f96a689a1e63a047e56d816d6e427bc663033e1e5b144926486856","observation_id":"0e6546aa-436b-482c-a420-8df54b01a64f","resolution":{"observed_at":"2026-08-15T16:41:17.898987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:18.721928Z","title":null,"venue":null,"work_id":"d6165255-4d60-4bb2-bf4a-673bdb1384b5","year":2025},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.903680Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:be32649753c5051eba812deb7844df40be4e4ee3399c1e5480e91aa90fbdaca6","observation_id":"9aa900e2-dd74-446a-b729-3620ee2c4933","resolution":{"observed_at":"2026-08-15T16:41:18.726864Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:18.706036Z","title":"Scaling laws for dictionary learning, April 2024","venue":null,"work_id":"6be6745e-da45-4866-9d1f-d475467badc0","year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.908093Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:accd80755900b5a28d1df5d895360a9fcd6994916b1b3ef4df33a95742a56e66","observation_id":"f12465cd-3e1a-4e94-ab8e-de3766466899","resolution":{"observed_at":"2026-08-15T16:41:18.710910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:18.690960Z","title":"The dark matter of neural networks? Transformer Circuits Thread, July 2024","venue":null,"work_id":"3d53e911-b40d-430e-9d98-831dde0af27d","year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.912679Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:e3009bdd64c2a75a93b25d86f26c2d9c84b2afc4af581f2ccb27126a2531c1eb","observation_id":"1c93900e-c762-4afa-8169-8f796bcf1ebe","resolution":{"observed_at":"2026-08-15T16:41:18.695412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10920","last_updated":"2024-08-20T15:04:37Z","snapshot_observed_at":"2026-08-16T13:25:10.743515Z","submitted_at":"2024-08-20T15:04:37Z","title":"Recurrent Neural Networks Learn to Store and Generate Sequences using Non-Linear Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10920","snapshot_observed_at":"2026-08-15T16:41:17.917288Z","title":"Recurrent neural networks learn to store and generate sequences using non-linear representations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.917288Z"},"links":{"cited_paper":"/paper/2408.10920","citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:5494213ef2c7c5b06e75a23b9241ff140201506f3a4a35790b54898a2c7e164a","observation_id":"4d85f121-2957-482e-8de5-c751fb6d4f24","resolution":{"observed_at":"2026-08-15T16:41:17.917288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:17.922234Z","title":"Projecting assumptions: The duality between sparse autoencoders and concept geometry","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.922234Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:a85d4880b965a09d56285ef9fb302c7ee4e242c18e3e1a8604c9925ae23e6ee4","observation_id":"f90ad7d1-f4a7-4204-8374-050ab2b9aaaf","resolution":{"observed_at":"2026-08-15T16:41:17.922234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-08-16T15:58:36.403050Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-15T16:41:17.926938Z","title":"Not all language model features are one-dimensionally linear","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.926938Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:861b79d2102f96fb0468992c3d11be63076799510c3c60425fe55f98a0ba3fd5","observation_id":"57afb69c-33db-495f-9a62-2aa63a6f8628","resolution":{"observed_at":"2026-08-15T16:41:17.926938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18235","last_updated":"2025-05-23T13:31:22Z","snapshot_observed_at":"2026-08-16T08:51:20.525641Z","submitted_at":"2025-05-23T13:31:22Z","title":"The Origins of Representation Manifolds in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18235","snapshot_observed_at":"2026-08-15T16:41:17.931527Z","title":"The origins of representation manifolds in large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.931527Z"},"links":{"cited_paper":"/paper/2505.18235","citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:855f319d06b6fb0254846287dc83b6a7a31d7919202a570dad668cc379bb9aeb","observation_id":"2a3b619f-5979-481f-8ecf-b4805c048e0e","resolution":{"observed_at":"2026-08-15T16:41:17.931527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14670","last_updated":"2025-03-25T17:00:02Z","snapshot_observed_at":"2026-08-16T13:07:56.598647Z","submitted_at":"2024-10-18T17:58:53Z","title":"Decomposing The Dark Matter of Sparse Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14670","snapshot_observed_at":"2026-08-15T16:41:17.936229Z","title":"Decomposing the dark matter of sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.936229Z"},"links":{"cited_paper":"/paper/2410.14670","citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:13408c2f29c097a845fc0bed2e5fd1fd2e33934cae07d134a011270a9ad21a47","observation_id":"8bb8bc4c-84e1-4924-a341-2a32bc3368da","resolution":{"observed_at":"2026-08-15T16:41:17.936229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07942","last_updated":"2024-12-10T22:01:38Z","snapshot_observed_at":"2026-08-17T14:11:00.883443Z","submitted_at":"2024-12-10T22:01:38Z","title":"Neural Scaling Laws Rooted in the Data Distribution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07942","snapshot_observed_at":"2026-08-15T16:41:17.941064Z","title":"Neural scaling laws rooted in the data distribution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.941064Z"},"links":{"cited_paper":"/paper/2412.07942","citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:1796bd314b1acb24baabe6f0f1773512dcfbdb5f798236056608d9b7c40b6366","observation_id":"bbbbc509-e555-49f5-b7a7-67536c77bcdd","resolution":{"observed_at":"2026-08-15T16:41:17.941064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:18.677217Z","title":"Toy models of superposition","venue":null,"work_id":"58d2edeb-2a60-45bc-a789-962bd5c15c73","year":2022},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.945989Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:ab20a869c1bef90faaf0f9cf02b8003209654dfd6c6df250c4219e634609ef5b","observation_id":"acaae035-2f28-4c48-bab0-27f29c25fe56","resolution":{"observed_at":"2026-08-15T16:41:18.681348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:17.950634Z","title":"A is for absorption: Studying feature splitting and absorption in sparse autoen- coders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.950634Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:7ccf597513096d216012e34c599728fb47aa7b42b9fceeef0c7c3cfabd56e67a","observation_id":"cda7aa24-42c3-4ffa-8ae3-089446d79f02","resolution":{"observed_at":"2026-08-15T16:41:17.950634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:18.661166Z","title":"The quantization model of neural scaling","venue":null,"work_id":"8d384b6f-4e19-4525-83d1-757d4e07f822","year":2023},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.955422Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:f38e89cb578c3807e82493c01ed97669c115d6f2c6d181083e59f07be6f9162a","observation_id":"577da0a0-2814-45b7-b6a4-08fff71f03de","resolution":{"observed_at":"2026-08-15T16:41:18.666252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:18.645471Z","title":"What is a linear representation? what is a multidimensional feature? Trans- former Circuits Thread, July 2024","venue":null,"work_id":"2b14eca4-91ee-4e7d-9d89-264584982040","year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.959623Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:38375a84f3265d7e7783740267d388179b8190fbc36b3d50fd9d582412313cd4","observation_id":"6ce62bc9-b4e6-4086-98bf-8315b461920e","resolution":{"observed_at":"2026-08-15T16:41:18.650305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:18.630285Z","title":"true features","venue":null,"work_id":"5d9c6bdb-3ae7-42cf-884e-a59177883c93","year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.964003Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:156f6c60ecbbc8b08bf1c70a99dc84893d30942eb7e2380da2edfe0535957ec3","observation_id":"07827292-5c3a-4b18-98f7-2ef6a05ff919","resolution":{"observed_at":"2026-08-15T16:41:18.635342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:18.615711Z","title":null,"venue":null,"work_id":"2fb4a017-d3ef-4ad5-b374-fca3360f5bad","year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.967862Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:73d0d21211868b6dc52fa556f9f0ca754040b627831ddf416d4fea22e3628b08","observation_id":"701121b1-450c-4f3c-9ea9-5793afdcf8c6","resolution":{"observed_at":"2026-08-15T16:41:18.620048Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-15T16:41:17.971966Z","title":"Scaling laws for neural language models","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.971966Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:c67e1d19dabf9c1acb5890a7b4c3fae91462f3dce1ee8738b87663931bb1e618","observation_id":"99a2c900-6c53-4f21-9585-adf2225f78ca","resolution":{"observed_at":"2026-08-15T16:41:17.971966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-15T16:41:17.976234Z","title":"Training compute-optimal large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.976234Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:da706f40d281a41854e522d6735394aa0d31da46d58bbe51eaf0be90d38b06b8","observation_id":"69b71016-be2d-407e-9fb8-34ed83a9e1f4","resolution":{"observed_at":"2026-08-15T16:41:17.976234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:18.600724Z","title":"Up- date on how we train saes","venue":null,"work_id":"a815bcac-20fd-436d-a884-99bf0cd2f471","year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.980575Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:ddba87b6b9609dc974a5950cf379a9b918497d2ad35d3846f016f21614d19a62","observation_id":"c2c9fdc0-fd90-4a8e-8182-ff875b3fec66","resolution":{"observed_at":"2026-08-15T16:41:18.605553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:18.585420Z","title":"features","venue":null,"work_id":"20a6bf96-2ec2-47ba-a628-9103f8bbbca2","year":2024},"citing_paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:17.984961Z"},"links":{"citing_paper":"/paper/2509.02565"},"observation_digest":"sha256:27e8eeb8efc4e2179ecef8d5c95d8ba54248141a5ca7610b2b23bcf20dd49959","observation_id":"6d873a55-c8c0-4f6c-b36f-35cf5426f2c9","resolution":{"observed_at":"2026-08-15T16:41:18.590150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.02565","last_updated":"2025-09-04T17:55:36Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T14:06:57.172961Z","submitted_at":"2025-09-02T17:59:50Z","title":"Understanding sparse autoencoder scaling in the presence of feature manifolds"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":1,"verified_fuzzy":10},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 5 inbound Pith citation observations for arXiv:2509.02565."}