{"as_of":"2026-08-09T14:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3b1e8f96d4e6fcac8117a4e9759a8f6b98f4247b0f773e605884bb38ae2a7c26","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T16:52:46.815838Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.08729","last_updated":"2025-04-11T17:56:09Z","snapshot_observed_at":"2026-08-07T16:06:27.536555Z","submitted_at":"2025-04-11T17:56:09Z","title":"Steering CLIP's vision transformer with sparse autoencoders","version":1},"cited_work":{"arxiv_id":"2504.08729","doi":"10.48550/arxiv.2504.08729","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.08729","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Steering CLIP’s vision transformer with sparse autoencoders","venue":"arXiv (Cornell University)","work_id":"f1d7c9f3-14ee-42eb-8b5a-1059948b953b","year":2025},"citing_paper":{"arxiv_id":"2506.01247","last_updated":"2026-05-26T21:34:46Z","snapshot_observed_at":"2026-08-07T11:44:23.107478Z","submitted_at":"2025-06-02T01:51:20Z","title":"Beyond Interpretability: When, Why, and How Sparse Autoencoders Enable Label-Free Visual Steering","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-19T11:35:01.836096Z"},"links":{"cited_paper":"/paper/2504.08729","citing_paper":"/paper/2506.01247"},"observation_digest":"sha256:2435b4ad6f4e122864a18280160d57009b2844821a646697b2b08792ffbe5688","observation_id":"d35f7571-dfb2-4706-ad5b-ff8b8fc3d865","resolution":{"observed_at":"2026-05-19T11:37:15.823687Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08729","last_updated":"2025-04-11T17:56:09Z","snapshot_observed_at":"2026-08-07T16:06:27.536555Z","submitted_at":"2025-04-11T17:56:09Z","title":"Steering CLIP's vision transformer with sparse autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08729","snapshot_observed_at":"2026-08-07T11:53:51.836956Z","title":"Steering clip's vision transformer with sparse autoencoders","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01247","last_updated":"2026-05-26T21:34:46Z","snapshot_observed_at":"2026-08-07T11:44:23.107478Z","submitted_at":"2025-06-02T01:51:20Z","title":"Beyond Interpretability: When, Why, and How Sparse Autoencoders Enable Label-Free Visual Steering","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:53:51.836956Z"},"links":{"cited_paper":"/paper/2504.08729","citing_paper":"/paper/2506.01247"},"observation_digest":"sha256:85a473b188a736cf191c1f5cd4db87bcb2923bc6f77f42d630cd7cfe8d81ca75","observation_id":"8344121f-33a7-4f0a-abfb-bbca9834bc8a","resolution":{"observed_at":"2026-08-07T11:53:51.836956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08729","last_updated":"2025-04-11T17:56:09Z","snapshot_observed_at":"2026-08-07T16:06:27.536555Z","submitted_at":"2025-04-11T17:56:09Z","title":"Steering CLIP's vision transformer with sparse autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08729","snapshot_observed_at":"2026-07-13T12:01:02.997589Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.03919","last_updated":"2026-04-05T01:08:19Z","snapshot_observed_at":"2026-08-08T17:42:54.273726Z","submitted_at":"2026-04-05T01:08:19Z","title":"Interpreting Video Representations with Spatio-Temporal Sparse Autoencoders","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T12:01:02.997589Z"},"links":{"cited_paper":"/paper/2504.08729","citing_paper":"/paper/2604.03919"},"observation_digest":"sha256:54742c1b9ec9132b9076e7be72fe32085fc7ffca7328433a189658f9d794e169","observation_id":"b4355137-defe-4ecc-9bf3-16a0739fbb7e","resolution":{"observed_at":"2026-07-13T12:01:02.997589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08729","last_updated":"2025-04-11T17:56:09Z","snapshot_observed_at":"2026-08-07T16:06:27.536555Z","submitted_at":"2025-04-11T17:56:09Z","title":"Steering CLIP's vision transformer with sparse autoencoders","version":1},"cited_work":{"arxiv_id":"2504.08729","doi":"10.48550/arxiv.2504.08729","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.08729","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Steering CLIP’s vision transformer with sparse autoencoders","venue":"arXiv (Cornell University)","work_id":"f1d7c9f3-14ee-42eb-8b5a-1059948b953b","year":2025},"citing_paper":{"arxiv_id":"2604.08846","last_updated":"2026-04-10T01:01:56Z","snapshot_observed_at":"2026-08-02T14:54:38.934183Z","submitted_at":"2026-04-10T01:01:56Z","title":"Dictionary-Aligned Concept Control for Safeguarding Multimodal LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T18:04:05.157103Z"},"links":{"cited_paper":"/paper/2504.08729","citing_paper":"/paper/2604.08846"},"observation_digest":"sha256:a3376ef11f26b62fc424ae015f7265d6581560d5ce1e9d09426339fe93a948da","observation_id":"56aa0dc0-f95c-43e3-bd1e-933cb9b1b4bb","resolution":{"observed_at":"2026-05-11T05:35:57.842361Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08729","last_updated":"2025-04-11T17:56:09Z","snapshot_observed_at":"2026-08-07T16:06:27.536555Z","submitted_at":"2025-04-11T17:56:09Z","title":"Steering CLIP's vision transformer with sparse autoencoders","version":1},"cited_work":{"arxiv_id":"2504.08729","doi":"10.48550/arxiv.2504.08729","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.08729","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Steering CLIP’s vision transformer with sparse autoencoders","venue":"arXiv (Cornell University)","work_id":"f1d7c9f3-14ee-42eb-8b5a-1059948b953b","year":2025},"citing_paper":{"arxiv_id":"2604.11467","last_updated":"2026-05-26T10:03:53Z","snapshot_observed_at":"2026-07-12T21:57:23.843830Z","submitted_at":"2026-04-13T13:41:57Z","title":"From Attribution to Action: A Human-Centered Application of Activation Steering","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T14:59:12.966608Z"},"links":{"cited_paper":"/paper/2504.08729","citing_paper":"/paper/2604.11467"},"observation_digest":"sha256:f8be5f6cd80c2e032ce85be3845e0ac6dd449438611f1383075930e4398ab46b","observation_id":"8bd5dcf7-0ce0-4bdb-a34e-98e8d13cf55b","resolution":{"observed_at":"2026-05-11T11:21:04.771995Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08729","last_updated":"2025-04-11T17:56:09Z","snapshot_observed_at":"2026-08-07T16:06:27.536555Z","submitted_at":"2025-04-11T17:56:09Z","title":"Steering CLIP's vision transformer with sparse autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08729","snapshot_observed_at":"2026-07-12T21:57:28.977088Z","title":"Steering clip’s vi- sion transformer with sparse autoencoders.arXiv preprint arXiv:2504.08729, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.11467","last_updated":"2026-05-26T10:03:53Z","snapshot_observed_at":"2026-07-12T21:57:23.843830Z","submitted_at":"2026-04-13T13:41:57Z","title":"From Attribution to Action: A Human-Centered Application of Activation Steering","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-12T21:57:28.977088Z"},"links":{"cited_paper":"/paper/2504.08729","citing_paper":"/paper/2604.11467"},"observation_digest":"sha256:4ae5eec410c03ef8484892325998c63ea41cc576558028e5bc6dc4a648067622","observation_id":"bea5905e-54a0-4fb1-bd7f-39caf9eb5af5","resolution":{"observed_at":"2026-07-12T21:57:28.977088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08729","last_updated":"2025-04-11T17:56:09Z","snapshot_observed_at":"2026-08-07T16:06:27.536555Z","submitted_at":"2025-04-11T17:56:09Z","title":"Steering CLIP's vision transformer with sparse autoencoders","version":1},"cited_work":{"arxiv_id":"2504.08729","doi":"10.48550/arxiv.2504.08729","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.08729","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Steering CLIP’s vision transformer with sparse autoencoders","venue":"arXiv (Cornell University)","work_id":"f1d7c9f3-14ee-42eb-8b5a-1059948b953b","year":2025},"citing_paper":{"arxiv_id":"2605.00899","last_updated":"2026-04-28T12:28:18Z","snapshot_observed_at":"2026-07-06T23:14:15.780028Z","submitted_at":"2026-04-28T12:28:18Z","title":"LatentDiff: Scaling Semantic Dataset Comparison to Millions of Images","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-09T20:16:30.677208Z"},"links":{"cited_paper":"/paper/2504.08729","citing_paper":"/paper/2605.00899"},"observation_digest":"sha256:effb1208c811a2a9c1635738b902d00b1c430c69d2bb5447878b36e8865415ff","observation_id":"448f09ef-6c93-41b0-9206-d763d0df3f35","resolution":{"observed_at":"2026-05-11T15:21:06.381353Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08729","last_updated":"2025-04-11T17:56:09Z","snapshot_observed_at":"2026-08-07T16:06:27.536555Z","submitted_at":"2025-04-11T17:56:09Z","title":"Steering CLIP's vision transformer with sparse autoencoders","version":1},"cited_work":{"arxiv_id":"2504.08729","doi":"10.48550/arxiv.2504.08729","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.08729","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Steering CLIP’s vision transformer with sparse autoencoders","venue":"arXiv (Cornell University)","work_id":"f1d7c9f3-14ee-42eb-8b5a-1059948b953b","year":2025},"citing_paper":{"arxiv_id":"2605.15961","last_updated":"2026-05-15T13:54:21Z","snapshot_observed_at":"2026-07-06T23:27:11.118592Z","submitted_at":"2026-05-15T13:54:21Z","title":"Sparse Autoencoders enable Robust and Interpretable Fine-tuning of CLIP models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T18:34:32.616965Z"},"links":{"cited_paper":"/paper/2504.08729","citing_paper":"/paper/2605.15961"},"observation_digest":"sha256:4ba7f46a20fd94f2aace6653ff2450f521891af1aad75791eb4916d88ba56296","observation_id":"b34ed1c4-f391-416a-8505-f9f43f1a1d9b","resolution":{"observed_at":"2026-05-20T18:38:52.822726Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08729","last_updated":"2025-04-11T17:56:09Z","snapshot_observed_at":"2026-08-07T16:06:27.536555Z","submitted_at":"2025-04-11T17:56:09Z","title":"Steering CLIP's vision transformer with sparse autoencoders","version":1},"cited_work":{"arxiv_id":"2504.08729","doi":"10.48550/arxiv.2504.08729","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.08729","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Steering CLIP’s vision transformer with sparse autoencoders","venue":"arXiv (Cornell University)","work_id":"f1d7c9f3-14ee-42eb-8b5a-1059948b953b","year":2025},"citing_paper":{"arxiv_id":"2606.07451","last_updated":"2026-06-05T16:54:40Z","snapshot_observed_at":"2026-07-06T23:47:05.104295Z","submitted_at":"2026-06-05T16:54:40Z","title":"TEVI: Text-Conditioned Editing of Visual Representations via Sparse Autoencoders for Improved Vision-Language Alignment","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-27T22:22:01.979434Z"},"links":{"cited_paper":"/paper/2504.08729","citing_paper":"/paper/2606.07451"},"observation_digest":"sha256:f3dd1216dfef796168790b33f85da96f105d3cfd4e3f06f2fc9d8449f354cdb9","observation_id":"e67791ac-c523-4e8d-84e7-fdc2638e14ed","resolution":{"observed_at":"2026-07-02T16:47:10.093222Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08729","last_updated":"2025-04-11T17:56:09Z","snapshot_observed_at":"2026-08-07T16:06:27.536555Z","submitted_at":"2025-04-11T17:56:09Z","title":"Steering CLIP's vision transformer with sparse autoencoders","version":1},"cited_work":{"arxiv_id":"2504.08729","doi":"10.48550/arxiv.2504.08729","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.08729","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Steering CLIP’s vision transformer with sparse autoencoders","venue":"arXiv (Cornell University)","work_id":"f1d7c9f3-14ee-42eb-8b5a-1059948b953b","year":2025},"citing_paper":{"arxiv_id":"2606.08031","last_updated":"2026-06-06T07:48:25Z","snapshot_observed_at":"2026-08-08T06:15:02.633485Z","submitted_at":"2026-06-06T07:48:25Z","title":"Vision-Language Asymmetry in Bistable Image Captioning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-27T20:17:06.897180Z"},"links":{"cited_paper":"/paper/2504.08729","citing_paper":"/paper/2606.08031"},"observation_digest":"sha256:cf27c7101926e3240011ee36f8116f0f4573722bda5d6cd0621264e13c41acbf","observation_id":"60660a5b-47e4-4e5c-b7bb-3adff6a1f9ad","resolution":{"observed_at":"2026-07-02T20:47:22.486788Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08729","last_updated":"2025-04-11T17:56:09Z","snapshot_observed_at":"2026-08-07T16:06:27.536555Z","submitted_at":"2025-04-11T17:56:09Z","title":"Steering CLIP's vision transformer with sparse autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08729","snapshot_observed_at":"2026-07-12T14:16:05.103480Z","title":"Been Kim, Martin Wattenberg, Justin Gilmer, Carrie Cai, James Wexler, Fernanda Vi´egas, and Rory Sayres","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.12629","last_updated":"2026-07-08T06:24:26Z","snapshot_observed_at":"2026-08-05T23:49:48.112866Z","submitted_at":"2026-06-10T19:34:31Z","title":"The Signs Were Always There: Training-Free Concept Detection and Steering in Raw Transformer Dimensions","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-12T14:16:05.103480Z"},"links":{"cited_paper":"/paper/2504.08729","citing_paper":"/paper/2606.12629"},"observation_digest":"sha256:ab82ba5e79ad0abc67c11bf3bfd72d47189f7aee0ff84fb4e126b7941768dd41","observation_id":"a9661b87-f770-4b14-babd-9af400a18c38","resolution":{"observed_at":"2026-07-12T14:16:05.103480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08729","last_updated":"2025-04-11T17:56:09Z","snapshot_observed_at":"2026-08-07T16:06:27.536555Z","submitted_at":"2025-04-11T17:56:09Z","title":"Steering CLIP's vision transformer with sparse autoencoders","version":1},"cited_work":{"arxiv_id":"2504.08729","doi":"10.48550/arxiv.2504.08729","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.08729","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Steering CLIP’s vision transformer with sparse autoencoders","venue":"arXiv (Cornell University)","work_id":"f1d7c9f3-14ee-42eb-8b5a-1059948b953b","year":2025},"citing_paper":{"arxiv_id":"2606.18667","last_updated":"2026-06-17T04:06:17Z","snapshot_observed_at":"2026-08-08T02:02:41.857530Z","submitted_at":"2026-06-17T04:06:17Z","title":"Can neurons speak? Semantic narration of vision at single-cell resolution","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T18:52:22.357765Z"},"links":{"cited_paper":"/paper/2504.08729","citing_paper":"/paper/2606.18667"},"observation_digest":"sha256:f66caf14ace53fbe04851036e277d89de06192ed803f5bff5b7314392a38499f","observation_id":"71047231-ddd8-4e20-95a6-74f4d2eba6cc","resolution":{"observed_at":"2026-07-04T02:49:25.383766Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08729","last_updated":"2025-04-11T17:56:09Z","snapshot_observed_at":"2026-08-07T16:06:27.536555Z","submitted_at":"2025-04-11T17:56:09Z","title":"Steering CLIP's vision transformer with sparse autoencoders","version":1},"cited_work":{"arxiv_id":"2504.08729","doi":"10.48550/arxiv.2504.08729","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.08729","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Steering CLIP’s vision transformer with sparse autoencoders","venue":"arXiv (Cornell University)","work_id":"f1d7c9f3-14ee-42eb-8b5a-1059948b953b","year":2025},"citing_paper":{"arxiv_id":"2606.26396","last_updated":"2026-06-24T21:26:43Z","snapshot_observed_at":"2026-08-02T16:34:16.438122Z","submitted_at":"2026-06-24T21:26:43Z","title":"At the Edge of Understanding: Sparse Autoencoders Trace The Limits of Transformer Generalization","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-26T01:27:39.812228Z"},"links":{"cited_paper":"/paper/2504.08729","citing_paper":"/paper/2606.26396"},"observation_digest":"sha256:2fc833d50285c5b3bb0ce9efcf6f52c0f62685221d87e8ba99db409bc02f9c21","observation_id":"e9de1279-f54c-4fb6-bdef-a67a6bab760b","resolution":{"observed_at":"2026-06-26T01:28:50.529147Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08729","last_updated":"2025-04-11T17:56:09Z","snapshot_observed_at":"2026-08-07T16:06:27.536555Z","submitted_at":"2025-04-11T17:56:09Z","title":"Steering CLIP's vision transformer with sparse autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08729","snapshot_observed_at":"2026-08-06T04:50:36.937136Z","title":"Steering clip’s vision transformer with sparse autoencoders.arXiv preprint arXiv:2504.08729,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05122","last_updated":"2026-08-06T17:40:28Z","snapshot_observed_at":"2026-08-09T14:11:54.354180Z","submitted_at":"2026-08-05T17:49:45Z","title":"IRIS: A Visual Cortex-Inspired Framework for Analyzing Orientation Selectivity in Vision Transformers","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:36.937136Z"},"links":{"cited_paper":"/paper/2504.08729","citing_paper":"/paper/2608.05122"},"observation_digest":"sha256:4f3bd77e08b04ebd3547eb69e39a460a31a9d4c34faacb736de11688302c02a0","observation_id":"97d1a87d-4e2c-4c1e-912e-7ad26715ad2e","resolution":{"observed_at":"2026-08-06T04:50:36.937136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08729","last_updated":"2025-04-11T17:56:09Z","snapshot_observed_at":"2026-08-07T16:06:27.536555Z","submitted_at":"2025-04-11T17:56:09Z","title":"Steering CLIP's vision transformer with sparse autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08729","snapshot_observed_at":"2026-08-08T16:52:46.815838Z","title":"Steering clip’s vision transformer with sparse autoencoders.arXiv preprint arXiv:2504.08729,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05122","last_updated":"2026-08-06T17:40:28Z","snapshot_observed_at":"2026-08-09T14:11:54.354180Z","submitted_at":"2026-08-05T17:49:45Z","title":"IRIS: A Visual Cortex-Inspired Framework for Analyzing Orientation Selectivity in Vision Transformers","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-08T16:52:46.815838Z"},"links":{"cited_paper":"/paper/2504.08729","citing_paper":"/paper/2608.05122"},"observation_digest":"sha256:da40f24e0345fa450de44a123c695c6239a5af79db3e6553ef25362c75753229","observation_id":"2102290c-13d0-4391-a8e8-556bd4603a9d","resolution":{"observed_at":"2026-08-08T16:52:46.815838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.08729/citation-record","integrity":"/paper/2504.08729/integrity","json":"/paper/2504.08729/citation-record.json","paper":"/paper/2504.08729"},"outbound":[],"paper":{"arxiv_id":"2504.08729","last_updated":"2025-04-11T17:56:09Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T16:06:27.536555Z","submitted_at":"2025-04-11T17:56:09Z","title":"Steering CLIP's vision transformer with sparse autoencoders"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2504.08729."}