{"as_of":"2026-08-07T05:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a9120d53dab5503f966f2b13dda8550fe06c72ac6f3d35d48c281be3b26d71fd","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T18:35:47.513717Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.08496/citation-record","integrity":"/paper/2606.08496/integrity","json":"/paper/2606.08496/citation-record.json","paper":"/paper/2606.08496"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"Aho and Jeffrey D","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:7f5d2325c926cf00a942639d8742dea00b80cdc0dbaeb07023afb237bf486eb5","observation_id":"1ad444f6-5a5c-4b00-aae5-d9b74ace4ec7","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":null,"venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:e09c745252e39a7c632b508cb4c649eb35570c3b7ee4c02771bd2fa7d781bb23","observation_id":"da5cf5ed-caba-4012-b729-99f19c0c57fe","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2234.322243","doi":"10.1145/322234.322243","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chandra and Dexter C","venue":"Journal of the ACM","work_id":"c3270592-bd69-4213-95e1-4aaf8312be9b","year":1981},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:1b965cb33602d498f2c18a20d8503584917940fc7bb056ebbb4794b96126cd48","observation_id":"08b5d8b5-3acf-4754-80a0-3dbcac33076d","resolution":{"observed_at":"2026-06-27T18:41:07.943145Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:12.175602+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:12.175602+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"Scalable training of","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:2acbd4c7e349343e9edeaaeefc1081d3bd70cf432339054e99560db0ed56eeb7","observation_id":"e3c297d8-9661-4e5c-b3bc-097ce78039bf","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":null,"venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:c9c1086cbf8fccaf2486cff8be03c3264747c4bdf92fe2ec1a53561737612e37","observation_id":"a81e7c9f-e256-4b26-9d5a-06b488361d9c","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"Tetreault , title =","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:6d1fda1d8cea8e0e8fc66438b28ca974bd8a96c688b09d9fcb04aa08aa96d997","observation_id":"0a668146-a8cf-403b-897e-2afed1f90f34","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"A Framework for Learning Predictive Structures from Multiple Tasks and Unlabeled Data , Volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:21a5476e9bf86bab4614948df9a1523eb11d1dad453c93498e38f91bc7d8ffb8","observation_id":"fc3909fe-5edd-448f-b543-0ac0125eda26","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":"2303.18223","doi":"10.18653/v1/d16-1080","metadata_source":"pith","pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Large Language Models","venue":"cs.CL","work_id":"de1b42b5-4a0a-4b1f-8c78-1f7fe21be6c9","year":2023},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:e25f3581b7df63147f0403a25aa8055a4ae8de759dce99df4294dc9a1567a5ce","observation_id":"dbb3337a-abd2-4f2c-b1d2-808a4728ed50","resolution":{"observed_at":"2026-07-02T22:57:25.982792Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"2021 , journal=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:8b55e428ef26cc415eea63af0830e0ad4f7d25780643bc86e3592d0c7abb4845","observation_id":"2b32f1a9-40d4-4501-b24a-c1ed8a1c651e","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:811895673845d96d48fd9b602c1c359b76f5d6a24a56ac38589b9ebfcb8334cc","observation_id":"bcda9964-31db-486a-9137-3f492f6b3e9f","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:673aca7d90180c39bceb48b81720d4cb04a56e1c99b9c435dee1a1edffd1755d","observation_id":"6bbbd0d9-2d59-4f17-b1b0-943dea600f32","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:90059ec485fdb6cc49ca36a781d14f07e034904c6e24b0a82dba11d843c0eb8b","observation_id":"57ba8fd8-4357-46af-afe5-620984375ab0","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"2023 , journal=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:67500a884ed1091d9fe1ea703e7f5e2f271373d678774d60af6e3a859b46f90a","observation_id":"2b64bf1c-8d8f-433c-be18-492314bc56b4","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-07-06T16:19:05.495349Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":"2309.08600","doi":"10.1145/1390156.1390191","metadata_source":"pith","pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","venue":"cs.LG","work_id":"51960d72-c69f-4db8-8efd-e90e8b4d9524","year":2023},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:90601e708f10e25fa4c0ff3e3fc8ec8bda9dc63dac110a711df0649074eb7e08","observation_id":"1a92013e-bd16-4b2e-81e3-4d5db2807fa3","resolution":{"observed_at":"2026-07-02T22:57:25.993498Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T22:49:19.66582+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T22:49:19.66582+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"2022 , journal=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:3c261d2a788170256a45615894f39395c4c11dddb52f06ea821de5debc85d174","observation_id":"b181e797-929f-4ab2-8728-9054461e9bc4","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"2023 , howpublished =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:d3254958420a3715e26eeb02665bf505693901cdb15ac088659f694aba426a85","observation_id":"05289afe-4dea-493d-86d1-88a09c942a0a","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:58b7a07ff747ae04a41853e351d7c6c311073756b60dd55cb68329c36214f69d","observation_id":"27984a4c-a49a-4dee-ba8d-5472582c9d70","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2412.08686","doi":"10.48550/arxiv.2412.08686","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ICLR, 2025.https://arxiv.org/abs/2412.08686","venue":"arXiv (Cornell University)","work_id":"d60263b3-7c39-40c6-b0e1-3e6865517f80","year":2024},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:4ef4a9d4f1ba59fce19b4bb9f5f1f00de7b73c7ce2cd1d28374f41244a086f31","observation_id":"4d66c6fd-c76c-448e-8033-24166c2740fa","resolution":{"observed_at":"2026-07-02T22:57:25.991123Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:e3b6e7d94a3744225cdac229a2790257fa48b6810c53656b5753122b36885362","observation_id":"559a3ae9-838d-46cf-b62b-a04f3f25ec01","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:046c48a65ab8e35e6de41b859de212f307730b24d04897bea3b1f4e2eaa6f7be","observation_id":"030c3517-e0b6-400c-bee3-7d2b304ab10e","resolution":{"observed_at":"2026-07-02T22:57:25.997818Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:e99fbe1018e32d193b090ce3c29341097bab1b62e729740cfcf8f0c15d37d012","observation_id":"7022aec4-39de-4727-80bd-e0b8efa50db8","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:8be9e5eb39e1912967aff1b819b7ba23fa912a13e1307578f01c1e96d8f71a0e","observation_id":"c03c9432-b8ee-4d8c-85aa-28f1d4ac3331","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:a4f499900fd59f6589cf37ef491fa111179f63ac4aa1c060f6da966c3e8c1deb","observation_id":"0bf6a163-827e-488c-9ff5-71eb315a42ac","resolution":{"observed_at":"2026-07-02T22:57:25.995144Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:de73f185bb2a6712b44add45afd47e7592f5a9a571c2ea2292831363c5724813","observation_id":"a37178b1-2a39-40d3-affc-eb67c10656cf","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"2024 , url=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:254d532aad0ba5806d7aca2feab4dfd5623b38a415ace2c1c010a63f7e1ebff6","observation_id":"b53d70c8-d53c-478c-a669-63207263afc5","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"Proceedings of the 7th BlackboxNLP Workshop: Analyzing and Interpreting Neural Networks for NLP , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:9eeccd85dc871c0c9aea2c7c6d6791b50802d4578bd6c0aef4ed033aacbb5b4c","observation_id":"9673bbd4-9b5d-4d2a-9a34-5b6e5a9dcf23","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:caf4fee555d781cfbc8cc60d1620afc1b40b7eba64f88a5d99f4156656edb550","observation_id":"e4e45c12-8ed9-4917-9d5c-43614a69f623","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"2024 , url=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:fa248dfed1a946efb25a396febd8a82c929241f45eea12f89ac32e5beee3c929","observation_id":"dde8f8d9-d6ff-4877-a79b-a5bccc316f35","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:fccfff29d82dc4eded23af3a5016d37ec6026049feab6968de42f29845243362","observation_id":"491bfac9-8d56-4005-bb77-289d76ef0b94","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:cafe6a35f3effc10b8f01d2dcf1be3b11debf6906b9d7668267c67b86ca5a74f","observation_id":"1cffb29d-776d-4955-9b39-c542a8a2e11b","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"Proceedings of the 19th Conference of the European Chapter of the Association for Computational Linguistics (Volume 5: Industry Track) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:3913453511172f47b3a962a2d9921668114620d2fe5872984318a9fcfaae1844","observation_id":"30890d41-edf9-429e-83c1-b0ffccb7a5da","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"Proceedings of the 6th BlackboxNLP Workshop: Analyzing and Interpreting Neural Networks for NLP , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:d25b9d166f1f01cc96c9f181b616c14a8f567dc9565d7df11c295f082154b4c2","observation_id":"a619e1f6-f4c4-4635-b391-39525541d75d","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"2024 , month =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:74a33c9b22137addbb19e6cdcf8fde6f25ead198b19ffb58c944242bf850a5a3","observation_id":"6a352624-5637-41aa-a792-e8a676ff87a4","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"Findings of the Association for Computational Linguistics: ACL 2024 , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:d2fbe73151419035c0254daa10c0b30dc6a6404d4f707e04776e7e394152761a","observation_id":"ef606b05-1a76-48ba-814f-3fdbe922430b","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-07-06T19:44:51.287226Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":"2411.02193","doi":"10.48550/arxiv.2411.02193","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving steering vectors by targeting sparse autoencoder features.arXiv preprint arXiv:2411.02193","venue":"arXiv (Cornell University)","work_id":"a13a989e-ea2e-4d17-b6be-0378be042e41","year":2023},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:757058ffc5390dc4f307d6f4b738e9f2ad24103564ef7dcb87c6df28ca24e27a","observation_id":"3caf54b0-a883-4c84-85a5-80e605dc1aeb","resolution":{"observed_at":"2026-07-02T22:57:25.979965Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04430","last_updated":"2025-02-10T19:55:17Z","snapshot_observed_at":"2026-08-06T22:57:40.145460Z","submitted_at":"2024-11-07T04:52:18Z","title":"Towards Unifying Interpretability and Control: Evaluation via Intervention","version":2},"cited_work":{"arxiv_id":"2411.04430","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.04430","snapshot_observed_at":"2026-07-02T22:57:25.994821Z","title":"arXiv preprint arXiv:2411.04430 , year=","venue":null,"work_id":"b6d6e371-ce80-41f7-8678-32be9875b3bf","year":2024},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"cited_paper":"/paper/2411.04430","citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:46c726d293580f41ec11ab1e5c05755212ce49a475985b38c86775d497458655","observation_id":"2818898b-3b77-4064-9fbe-7524327f9630","resolution":{"observed_at":"2026-07-02T22:57:25.996505Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16014","last_updated":"2024-04-30T17:54:04Z","snapshot_observed_at":"2026-08-02T10:59:21.418230Z","submitted_at":"2024-04-24T17:47:22Z","title":"Improving Dictionary Learning with Gated Sparse Autoencoders","version":2},"cited_work":{"arxiv_id":"2404.16014","doi":"10.48550/arxiv.2404.16014","metadata_source":"pith","pith_arxiv_id":"2404.16014","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving Dictionary Learning with Gated Sparse Autoencoders","venue":"cs.LG","work_id":"3f6ee9ca-2e43-4536-a753-1e8c881c9229","year":2024},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"cited_paper":"/paper/2404.16014","citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:c5a51babb759e88e6647a544e072d675e18f1a070b503492aaf8b5e637fd0edb","observation_id":"b22810d4-02f7-4524-8a53-5d68d9cb0cda","resolution":{"observed_at":"2026-07-02T22:57:25.998880Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"Distill , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:d8981c3e419a4d71c3f4d261a4912f2974ed55a175050acaee80f5717b458396","observation_id":"52180db1-e619-46f7-9ca5-f1db35e8ddec","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13928","last_updated":"2025-08-06T13:47:10Z","snapshot_observed_at":"2026-07-06T19:35:35.229351Z","submitted_at":"2024-10-17T17:56:01Z","title":"Automatically Interpreting Millions of Features in Large Language Models","version":3},"cited_work":{"arxiv_id":"2410.13928","doi":"10.48550/arxiv.2410.13928","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.13928","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Automatically interpreting millions of features in large language models","venue":"arXiv (Cornell University)","work_id":"e7fd7fcc-4a8e-4299-ae13-7030d44df0e5","year":2024},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"cited_paper":"/paper/2410.13928","citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:9a16a739e08868283f138efb78157d90a14ca09a79c6a64a9c8d9deded278910","observation_id":"7ffd95b3-ce31-4606-902a-cf1f63dc9dc1","resolution":{"observed_at":"2026-07-02T22:57:25.986871Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"Forty-first International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:77ba3604ecd7a54a4718edffe00782af93d395ee71dcaedd763e22dc64d00e3a","observation_id":"c2758295-a72a-4ab0-a289-3e581ffced64","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:35:47.513717Z","title":"2025 , month =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-27T18:35:47.513717Z"},"links":{"citing_paper":"/paper/2606.08496"},"observation_digest":"sha256:8340f170142b898972ca69acbddfd6002a7899f6f8dd402870b21c096f24c10c","observation_id":"6a52591a-39e1-4332-a1b7-b42388990864","resolution":{"observed_at":"2026-06-27T18:35:47.513717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.08496","last_updated":"2026-06-07T07:54:25Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-31T19:48:50.729266Z","submitted_at":"2026-06-07T07:54:25Z","title":"SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":31,"verified_exact":4,"verified_fuzzy":0},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2606.08496."}