{"as_of":"2026-08-23T16:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:948e7e9bf38008b9c023e991b386f026fbb640a874ed0c503eb3c01e3fb8b3e8","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:24:52.521413Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T05:02:51.383123Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T14:23:30.730711Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"cited_work":{"arxiv_id":"2507.08473","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.08473","snapshot_observed_at":"2026-06-29T14:23:30.730711Z","title":"Evaluating SAE interpretability without explanations.arXiv preprint arXiv:2507.08473, 2025","venue":null,"work_id":"eb992194-2a33-4b55-9b66-a0b7336607ef","year":2025},"citing_paper":{"arxiv_id":"2605.12874","last_updated":"2026-05-13T01:41:38Z","snapshot_observed_at":"2026-08-14T18:27:17.550876Z","submitted_at":"2026-05-13T01:41:38Z","title":"Descriptive Collision in Sparse Autoencoder Auto-Interpretability: When One Explanation Describes Many Features","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:38.363693Z"},"links":{"cited_paper":"/paper/2507.08473","citing_paper":"/paper/2605.12874"},"observation_digest":"sha256:2745c0c8bbf849bcb4f5a5da1eb4a9f747eaf540e9bf9bd241a7949ac2442665","observation_id":"383acfd1-95fc-479c-940c-8c7bdf830e13","resolution":{"observed_at":"2026-05-14T20:27:59.001783Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"cited_work":{"arxiv_id":"2507.08473","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.08473","snapshot_observed_at":"2026-06-29T14:23:30.730711Z","title":"Evaluating SAE interpretability without explanations.arXiv preprint arXiv:2507.08473, 2025","venue":null,"work_id":"eb992194-2a33-4b55-9b66-a0b7336607ef","year":2025},"citing_paper":{"arxiv_id":"2605.28149","last_updated":"2026-08-04T06:19:42Z","snapshot_observed_at":"2026-08-07T23:09:28.260788Z","submitted_at":"2026-05-27T08:31:43Z","title":"Sign-Aware Gated Sparse Autoencoders: Modeling Anticorrelated Features with Bi-Jump-ReLU Activations","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-29T14:16:44.232080Z"},"links":{"cited_paper":"/paper/2507.08473","citing_paper":"/paper/2605.28149"},"observation_digest":"sha256:f71d259e815feb326c185a9af9c9ef2a60b678bef25c8fe12ab06276733c8244","observation_id":"6352d0cd-9034-4684-9b59-2d1dda2092a1","resolution":{"observed_at":"2026-06-29T14:23:30.732398Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.08473","snapshot_observed_at":"2026-08-04T05:02:51.383123Z","title":"Evaluating SAE interpretability without explanations.arXiv preprint arXiv:2507.08473, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.28149","last_updated":"2026-08-04T06:19:42Z","snapshot_observed_at":"2026-08-07T23:09:28.260788Z","submitted_at":"2026-05-27T08:31:43Z","title":"Sign-Aware Gated Sparse Autoencoders: Modeling Anticorrelated Features with Bi-Jump-ReLU Activations","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T05:02:51.383123Z"},"links":{"cited_paper":"/paper/2507.08473","citing_paper":"/paper/2605.28149"},"observation_digest":"sha256:6fb9e10e680597b316d1bf2276af66d3c476909617babe43af61f449da6d89b7","observation_id":"a101d157-3758-431b-9819-edb9f7677b77","resolution":{"observed_at":"2026-08-04T05:02:51.383123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.08473/citation-record","integrity":"/paper/2507.08473/integrity","json":"/paper/2507.08473/citation-record.json","paper":"/paper/2507.08473"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:24:54.535046Z","title":"From mechanistic interpretability to mechanistic biology: Training, evaluating, and interpreting sparse autoencoders on protein language models","venue":null,"work_id":"5f779cb8-f1e1-4bbe-8e11-8512d022d2aa","year":2025},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:27.056872Z"},"links":{"citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:341c4ffc8e339d2c1a6165305bdd395d87fa06f46f6e76cae96cbee1a0293a76","observation_id":"82bcfe99-8fda-4053-8bbf-26f566d20464","resolution":{"observed_at":"2026-08-06T18:24:54.605768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02737","last_updated":"2025-02-04T21:43:16Z","snapshot_observed_at":"2026-08-14T05:03:05.661970Z","submitted_at":"2025-02-04T21:43:16Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02737","snapshot_observed_at":"2026-08-06T18:24:50.360187Z","title":"Smollm2: When smol goes big--data-centric training of a small language model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:50.360187Z"},"links":{"cited_paper":"/paper/2502.02737","citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:0734c48c52a719183b04ba9912fd6eac05c0f984aa8db8603f390c25f5cdd8ea","observation_id":"219379b0-a2d0-4faa-8c54-bb64b5abba40","resolution":{"observed_at":"2026-08-06T18:24:50.360187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11179","last_updated":"2024-10-15T01:38:03Z","snapshot_observed_at":"2026-08-16T13:09:22.337092Z","submitted_at":"2024-10-15T01:38:03Z","title":"Interpretability as Compression: Reconsidering SAE Explanations of Neural Activations with MDL-SAEs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11179","snapshot_observed_at":"2026-08-06T18:24:50.455819Z","title":"Interpretability as compression: Reconsidering sae explanations of neural activations with mdl-saes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:50.455819Z"},"links":{"cited_paper":"/paper/2410.11179","citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:c2537aadaa12eb6e357504f9889069b84326e8bf0b41e621a83f21f670cce77d","observation_id":"47144a4c-fd38-4e8c-bbd6-d03a2966b4e6","resolution":{"observed_at":"2026-08-06T18:24:50.455819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:24:54.359192Z","title":"Language models can explain neurons in language models","venue":null,"work_id":"8ce1868d-fc5c-4a68-bd36-7504863aa42f","year":2023},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:50.501086Z"},"links":{"citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:e67bb6e34c41f0eb4351511e1a92d06875743ced797113e3482ac19123a6a53b","observation_id":"75c812de-2076-4659-abb1-1d33c44a1092","resolution":{"observed_at":"2026-08-06T18:24:54.449384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.12606","last_updated":"2021-05-02T19:27:06Z","snapshot_observed_at":"2026-08-18T19:39:52.667484Z","submitted_at":"2020-10-23T18:31:13Z","title":"Exemplary Natural Images Explain CNN Activations Better than State-of-the-Art Feature Visualization","version":3},"cited_work":{"arxiv_id":"2010.12606","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.12606","snapshot_observed_at":"2026-08-06T18:24:53.210703Z","title":"Exemplary Natural Images Explain CNN Activations Better than State-of-the-Art Feature Visualization","venue":"cs.CV","work_id":"6043ec2e-5e6c-46bf-ab55-e437f9385829","year":2020},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:50.650215Z"},"links":{"cited_paper":"/paper/2010.12606","citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:87d279c4fbf6610730c797c7a3e2c0eaa8239c0e21f7bdd3606ea396804556d2","observation_id":"fe227b72-ccfb-4d8a-b1a8-632bbd80d096","resolution":{"observed_at":"2026-08-06T18:24:53.303384Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:24:54.214424Z","title":"Reading tea leaves: How humans interpret topic models","venue":null,"work_id":"525be778-055a-45ba-967e-5199a6ceef42","year":2009},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:50.721265Z"},"links":{"citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:e118e0aafb8db42575289eb1f3414fb9837b271a8f269b98c9d0786e22ae6dd5","observation_id":"2c147c9c-345d-4283-805f-31c9f9e3743e","resolution":{"observed_at":"2026-08-06T18:24:54.285149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:24:50.780922Z","title":"A is for absorption: Studying feature splitting and absorption in sparse autoencoders, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:50.780922Z"},"links":{"citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:7c8f57fd674b8c2d3001f05a3455d8733dd9d3ca6edff26eeac50483c1c2b2b8","observation_id":"888b6e5f-4340-4154-8c1a-d9d24aa19d0d","resolution":{"observed_at":"2026-08-06T18:24:50.780922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-21T17:39:12.921162Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-06T18:24:50.875009Z","title":"Sparse autoencoders find highly interpretable features in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:50.875009Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:6c5c1b3a17a9ddaf795d09bca4611ddebce7420097d13180928bfed248211871","observation_id":"7895f8ae-cbde-4e41-95e7-80cf0be35e5e","resolution":{"observed_at":"2026-08-06T18:24:50.875009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04093","last_updated":"2024-06-06T14:10:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-06T14:10:12Z","title":"Scaling and evaluating sparse autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04093","snapshot_observed_at":"2026-08-06T18:24:50.966835Z","title":"Scaling and evaluating sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:50.966835Z"},"links":{"cited_paper":"/paper/2406.04093","citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:25f33d779578244404b99d8b7a7c55f7b9c075c051eb20f30e768ce27b2c765a","observation_id":"ebbef96f-72b4-48ec-9e9e-65f41f72db67","resolution":{"observed_at":"2026-08-06T18:24:50.966835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03662","last_updated":"2024-09-07T22:53:31Z","snapshot_observed_at":"2026-08-18T00:50:55.820507Z","submitted_at":"2024-06-06T00:28:49Z","title":"The Missing Curve Detectors of InceptionV1: Applying Sparse Autoencoders to InceptionV1 Early Vision","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03662","snapshot_observed_at":"2026-08-06T18:24:51.055259Z","title":"The missing curve detectors of inceptionv1: Applying sparse autoencoders to inceptionv1 early vision, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:51.055259Z"},"links":{"cited_paper":"/paper/2406.03662","citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:3377b9df8660dfc7d9c752763126074c061b2ee3073f77bac89b7b94e35ff3b1","observation_id":"9dc2bc81-ca36-432c-96f4-b889f65766a2","resolution":{"observed_at":"2026-08-06T18:24:51.055259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08319","last_updated":"2025-05-29T15:26:06Z","snapshot_observed_at":"2026-08-16T12:58:57.788575Z","submitted_at":"2025-01-14T18:53:00Z","title":"Enhancing Automated Interpretability with Output-Centric Feature Descriptions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08319","snapshot_observed_at":"2026-08-06T18:24:51.096631Z","title":"Enhancing automated interpretability with output-centric feature descriptions, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:51.096631Z"},"links":{"cited_paper":"/paper/2501.08319","citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:a99fa5c98740e9cf1487248f42172f34465064f7b8c9d43089ea8e397d05d350","observation_id":"9bab99dc-d58a-4897-a207-f157f837be27","resolution":{"observed_at":"2026-08-06T18:24:51.096631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09532","last_updated":"2025-06-04T13:27:28Z","snapshot_observed_at":"2026-08-19T01:15:12.408846Z","submitted_at":"2025-03-12T16:49:02Z","title":"SAEBench: A Comprehensive Benchmark for Sparse Autoencoders in Language Model Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09532","snapshot_observed_at":"2026-08-06T18:24:51.180244Z","title":"Saebench: A comprehensive benchmark for sparse autoencoders in language model interpretability, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:51.180244Z"},"links":{"cited_paper":"/paper/2503.09532","citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:8ca975fc903dc6091e1eb8ca360960703f0ced8ee0d1ef0e663a51db099030d8","observation_id":"0a50bec3-c959-4b47-af7f-34a36a929314","resolution":{"observed_at":"2026-08-06T18:24:51.180244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T18:24:51.252747Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:51.252747Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:1945beca80b84b3e4382328d3be1700c651cd48486460ca33a328d487b6311f5","observation_id":"e5588cd8-eccd-402a-b791-69b3cb6c5229","resolution":{"observed_at":"2026-08-06T18:24:51.252747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01824","last_updated":"2025-03-03T18:49:59Z","snapshot_observed_at":"2026-08-16T12:53:28.794411Z","submitted_at":"2025-03-03T18:49:59Z","title":"From superposition to sparse codes: interpretable representations in neural networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01824","snapshot_observed_at":"2026-08-06T18:24:51.328290Z","title":"From superposition to sparse codes: interpretable representations in neural networks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:51.328290Z"},"links":{"cited_paper":"/paper/2503.01824","citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:e1685313d57f2ca262f8f1367dde57ac9621406a97dd3adac5fc41d05d3651bb","observation_id":"68df6f77-0ab7-4466-a265-7855fc030ba9","resolution":{"observed_at":"2026-08-06T18:24:51.328290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.04612","last_updated":"2020-12-29T00:32:21Z","snapshot_observed_at":"2026-08-21T10:46:03.599129Z","submitted_at":"2020-07-09T07:47:28Z","title":"Concept Bottleneck Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.04612","snapshot_observed_at":"2026-08-06T18:24:51.398140Z","title":"Concept bottleneck models","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:51.398140Z"},"links":{"cited_paper":"/paper/2007.04612","citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:ce0b6a890df0516b22bd9878f1a9bf9672fa7746f7bb5250143c149f347ee148","observation_id":"d09bee25-b238-425f-8bf4-50775d0c9729","resolution":{"observed_at":"2026-08-06T18:24:51.398140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10785","last_updated":"2024-12-16T21:02:15Z","snapshot_observed_at":"2026-08-16T13:34:07.445330Z","submitted_at":"2024-07-15T15:03:01Z","title":"Learning biologically relevant features in a pathology foundation model using sparse autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10785","snapshot_observed_at":"2026-08-06T18:24:51.445003Z","title":"Learning biologically relevant features in a pathology foundation model using sparse autoencoders, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:51.445003Z"},"links":{"cited_paper":"/paper/2407.10785","citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:defbacf9414fb73ff1cbe5f42a8f6f5502e2d3bc64cb7255bfcbe60e99737efa","observation_id":"ef608de2-630d-491a-9053-69b01248b126","resolution":{"observed_at":"2026-08-06T18:24:51.445003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05147","last_updated":"2024-08-19T07:51:05Z","snapshot_observed_at":"2026-08-15T15:50:24.074149Z","submitted_at":"2024-08-09T16:06:42Z","title":"Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05147","snapshot_observed_at":"2026-08-06T18:24:51.490925Z","title":"Gemma scope: Open sparse autoencoders everywhere all at once on gemma 2, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:51.490925Z"},"links":{"cited_paper":"/paper/2408.05147","citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:4ceac771a7c00371618d0721ce4ace0792395f7205e4f94059e69203c26854a2","observation_id":"e207ae10-aca5-4ae7-bb5b-b35637abd0ca","resolution":{"observed_at":"2026-08-06T18:24:51.490925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14032","last_updated":"2021-02-02T23:46:51Z","snapshot_observed_at":"2026-08-10T01:51:26.659486Z","submitted_at":"2020-06-24T20:37:05Z","title":"Compositional Explanations of Neurons","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14032","snapshot_observed_at":"2026-08-06T18:24:51.541971Z","title":"Compositional explanations of neurons","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:51.541971Z"},"links":{"cited_paper":"/paper/2006.14032","citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:c0fd1d5c9ba372c8407ddff8cc2424451be96dc2aa208d29f961c5a7ad95477b","observation_id":"5b231f97-8fd4-4e64-9058-4e18fd2cdbb3","resolution":{"observed_at":"2026-08-06T18:24:51.541971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18838","last_updated":"2025-01-31T01:12:50Z","snapshot_observed_at":"2026-08-20T17:09:35.504109Z","submitted_at":"2025-01-31T01:12:50Z","title":"Partially Rewriting a Transformer in Natural Language","version":1},"cited_work":{"arxiv_id":"2501.18838","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.18838","snapshot_observed_at":"2026-08-06T18:24:52.807833Z","title":"Partially Rewriting a Transformer in Natural Language","venue":"cs.LG","work_id":"8b5226f3-a945-4496-a00f-2af0253ef1f1","year":2025},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:51.592477Z"},"links":{"cited_paper":"/paper/2501.18838","citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:93585d3df7ded288ed4cc2d2ec63a244c8eade0c5de3a9b630ca4586b0923ec1","observation_id":"8ed14f3c-06e1-4796-bc8f-70f81dda4c00","resolution":{"observed_at":"2026-08-06T18:24:52.843511Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13928","last_updated":"2025-08-06T13:47:10Z","snapshot_observed_at":"2026-08-16T13:08:17.757544Z","submitted_at":"2024-10-17T17:56:01Z","title":"Automatically Interpreting Millions of Features in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13928","snapshot_observed_at":"2026-08-06T18:24:51.640958Z","title":"Automatically interpreting millions of features in large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:51.640958Z"},"links":{"cited_paper":"/paper/2410.13928","citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:5cc95c4a97a17d0ad4c4a45c6a0c3d4f7ba7aa5405ac0cc3142558eeda42d5be","observation_id":"6e6b6711-37ba-499f-b663-95b831dca041","resolution":{"observed_at":"2026-08-06T18:24:51.640958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:24:54.058833Z","title":"Spine: Sparse interpretable neural embeddings","venue":null,"work_id":"227e877d-1f8c-471f-819b-8d958252d1d5","year":2018},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:51.718987Z"},"links":{"citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:34849f8c7a58dd66f3ea51fcb53c443d6ad88d3154a85528f99083bf106b8d97","observation_id":"3589bb0f-3603-42e3-84bd-8cb9977fac8b","resolution":{"observed_at":"2026-08-06T18:24:54.129460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:24:51.766290Z","title":"Unpacking sdxl turbo: Interpreting text-to-image models with sparse autoencoders, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:51.766290Z"},"links":{"citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:71c36b2fc0e587402e46635c8a4cd577dd083716f90d591a47c37d570475dcca","observation_id":"84a75aa4-6d5a-488b-bd85-be1070abb129","resolution":{"observed_at":"2026-08-06T18:24:51.766290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T18:24:51.825557Z","title":"The llama 3 herd of models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:51.825557Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:ec1a893164354aa17019afe9610dd4a3df3f4f34a296ae71e0f60c2e106d64e6","observation_id":"8d2964b7-504a-4f00-9221-c49c86348ed2","resolution":{"observed_at":"2026-08-06T18:24:51.825557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:24:51.875108Z","title":"Daniel Freeman, Theodore R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:51.875108Z"},"links":{"citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:f93b0dec0b91a13ef5af00edeb9e8a25ce1cf788cdf1958ddd9f66b619200d33","observation_id":"ff64be5b-f0c7-45cc-b993-9effba4be3ac","resolution":{"observed_at":"2026-08-06T18:24:51.875108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:24:53.848970Z","title":"A sample survey study of poly-semantic neurons in deep cnns","venue":null,"work_id":"a9c9c67f-3b95-4ecd-8442-d2a0e279656f","year":2023},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:51.915009Z"},"links":{"citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:4a87c7b21ed04fc3e0b1889df1bbd39068b60b463c1a70da4cf153a81a0bad4c","observation_id":"3f58d450-f26b-4f00-aee0-e64a6954daaa","resolution":{"observed_at":"2026-08-06T18:24:53.967022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:24:53.699720Z","title":"Zimmermann, Thomas Klein, and Wieland Brendel","venue":null,"work_id":"d374e2a6-bab7-4162-8f34-f27dd97f2e65","year":2023},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:51.958091Z"},"links":{"citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:05bf11369c1ee3426e412b4b4a8dc5957e5bb6b69c766891873871da5165f705","observation_id":"77f3b985-ad1f-4ff2-9c56-3416f7d9ea43","resolution":{"observed_at":"2026-08-06T18:24:53.785484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:24:53.576683Z","title":"Zimmermann, David A","venue":null,"work_id":"c2295b01-900d-449c-8570-f4379cb41a26","year":2024},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:52.065901Z"},"links":{"citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:f82bb6b7b3c5ed73bb78d1764220bcaa0e3c9454710ac8dea0ce860434d9071b","observation_id":"7ef9b489-0c24-4859-b11c-e56fc91e2ccb","resolution":{"observed_at":"2026-08-06T18:24:53.637297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:24:52.156647Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:52.156647Z"},"links":{"citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:0c8e24b4a5c843fb45d0b230ee297f32156ec02d3c197c75c2c858913a3f321d","observation_id":"ec1804b5-e4cb-46a1-aa8d-5a021b37e7a7","resolution":{"observed_at":"2026-08-06T18:24:52.156647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:24:52.337302Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:52.337302Z"},"links":{"citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:30b9845f99b187da3161f77c7d942a6304d841a0724bd8474820ce29262405d5","observation_id":"1ecc6952-4f52-4ded-887d-537c24addf7b","resolution":{"observed_at":"2026-08-06T18:24:52.337302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:24:52.445651Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:52.445651Z"},"links":{"citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:0dd405fc3b20397ec024df552384468f5b8907f896b5081fd01c804a55988fd5","observation_id":"4a204113-4d62-495d-abd6-fb40878bf376","resolution":{"observed_at":"2026-08-06T18:24:52.445651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:24:53.430512Z","title":"f.[RQ^ UWM9 =qNղl 8sj W s sn|x` Wy i G2 q N","venue":null,"work_id":"0b11cc84-1e28-4463-88be-43c93f943093","year":2000},"citing_paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:52.521413Z"},"links":{"citing_paper":"/paper/2507.08473"},"observation_digest":"sha256:100c1fd62a30018dbe9b5472b8511182cdfa7da85d535b0db2003c426bfe2812","observation_id":"98bdf8fb-2816-4220-a654-ee8107b20c25","resolution":{"observed_at":"2026-08-06T18:24:53.488648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.08473","last_updated":"2025-07-11T10:31:53Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-21T00:54:47.457781Z","submitted_at":"2025-07-11T10:31:53Z","title":"Evaluating SAE interpretability without explanations"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":21,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 3 inbound Pith citation observations for arXiv:2507.08473."}