{"as_of":"2026-08-09T09:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:632fbd2c3074b88463130350aa84762368ade294f0e3d7c808fb50b66c453a35","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:50:19.542914Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T19:34:24.408268Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"cited_work":{"arxiv_id":"2509.00328","doi":"10.48550/arxiv.2509.00328","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00328","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mechanistic interpretability for steering vision-language-action models","venue":"ArXiv.org","work_id":"b81aac23-24d1-45f9-aca2-f6f949ee9d09","year":2025},"citing_paper":{"arxiv_id":"2604.02965","last_updated":"2026-04-03T10:55:51Z","snapshot_observed_at":"2026-08-03T01:48:29.110837Z","submitted_at":"2026-04-03T10:55:51Z","title":"Open-Loop Planning, Closed-Loop Verification: Speculative Verification for VLA","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T19:45:17.852646Z"},"links":{"cited_paper":"/paper/2509.00328","citing_paper":"/paper/2604.02965"},"observation_digest":"sha256:b7ea06cdc1177fbcea60761a2c0bec45d275f7b92ee1efb7773e6b7771f920fe","observation_id":"bf15ee03-112f-4632-b1c1-54315d2e19cd","resolution":{"observed_at":"2026-05-13T19:48:11.453180Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.00328","snapshot_observed_at":"2026-07-13T12:01:02.997589Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.03919","last_updated":"2026-04-05T01:08:19Z","snapshot_observed_at":"2026-08-08T17:42:54.273726Z","submitted_at":"2026-04-05T01:08:19Z","title":"Interpreting Video Representations with Spatio-Temporal Sparse Autoencoders","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T12:01:02.997589Z"},"links":{"cited_paper":"/paper/2509.00328","citing_paper":"/paper/2604.03919"},"observation_digest":"sha256:f0cab9facf7ff90a7ce057637ad3657b9fcbb38083b01c6166000758df768b2a","observation_id":"9a224e0d-5c59-48c7-86dc-70addb5af670","resolution":{"observed_at":"2026-07-13T12:01:02.997589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"cited_work":{"arxiv_id":"2509.00328","doi":"10.48550/arxiv.2509.00328","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00328","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mechanistic interpretability for steering vision-language-action models","venue":"ArXiv.org","work_id":"b81aac23-24d1-45f9-aca2-f6f949ee9d09","year":2025},"citing_paper":{"arxiv_id":"2604.19018","last_updated":"2026-04-21T03:09:46Z","snapshot_observed_at":"2026-07-06T23:05:44.499005Z","submitted_at":"2026-04-21T03:09:46Z","title":"Local Linearity of LLMs Enables Activation Steering via Model-Based Linear Optimal Control","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-10T02:31:07.932802Z"},"links":{"cited_paper":"/paper/2509.00328","citing_paper":"/paper/2604.19018"},"observation_digest":"sha256:e3ccb9b7a547d1dd3eb354644ddb8d5056de92a439143c259b13241f315bf1c4","observation_id":"6c41a8b1-39f6-4a41-ae47-35e1489cc70d","resolution":{"observed_at":"2026-05-10T02:32:49.468387Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"cited_work":{"arxiv_id":"2509.00328","doi":"10.48550/arxiv.2509.00328","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00328","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mechanistic interpretability for steering vision-language-action models","venue":"ArXiv.org","work_id":"b81aac23-24d1-45f9-aca2-f6f949ee9d09","year":2025},"citing_paper":{"arxiv_id":"2605.17204","last_updated":"2026-05-17T00:20:17Z","snapshot_observed_at":"2026-08-02T21:41:56.839397Z","submitted_at":"2026-05-17T00:20:17Z","title":"Event-Grounded Sparse Autoencoders for Vision-Language-Action Policies","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T13:43:33.273259Z"},"links":{"cited_paper":"/paper/2509.00328","citing_paper":"/paper/2605.17204"},"observation_digest":"sha256:b3a211a66809dd52fcf5898ebdf4d4ba4ca3215d2cd983c5214236648f1d9b6f","observation_id":"47fd72ee-9b62-48ea-9ff3-e4c2e0a86c3c","resolution":{"observed_at":"2026-05-20T13:48:19.969424Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"cited_work":{"arxiv_id":"2509.00328","doi":"10.48550/arxiv.2509.00328","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00328","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mechanistic interpretability for steering vision-language-action models","venue":"ArXiv.org","work_id":"b81aac23-24d1-45f9-aca2-f6f949ee9d09","year":2025},"citing_paper":{"arxiv_id":"2606.10495","last_updated":"2026-06-09T07:18:01Z","snapshot_observed_at":"2026-08-02T10:00:24.356645Z","submitted_at":"2026-06-09T07:18:01Z","title":"Act on What You See: Unlocking Safe Social Navigation in Vision-Language-Action Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-27T12:52:38.764427Z"},"links":{"cited_paper":"/paper/2509.00328","citing_paper":"/paper/2606.10495"},"observation_digest":"sha256:5839e8e0b7d752fe29540d321661c86f22b8820bbfa23a2fb73703cf9737124c","observation_id":"7943ce1b-2f8b-4d09-9691-f66528391fe9","resolution":{"observed_at":"2026-07-03T06:07:41.715166Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"cited_work":{"arxiv_id":"2509.00328","doi":"10.48550/arxiv.2509.00328","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00328","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mechanistic interpretability for steering vision-language-action models","venue":"ArXiv.org","work_id":"b81aac23-24d1-45f9-aca2-f6f949ee9d09","year":2025},"citing_paper":{"arxiv_id":"2606.12299","last_updated":"2026-06-10T16:34:49Z","snapshot_observed_at":"2026-08-02T08:10:49.488336Z","submitted_at":"2026-06-10T16:34:49Z","title":"Learning What to Say to Your VLA: Mostly Harmless Vision Language Action Model Steering","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T10:02:35.406713Z"},"links":{"cited_paper":"/paper/2509.00328","citing_paper":"/paper/2606.12299"},"observation_digest":"sha256:6500af38b408e26fa02dbacf89b559ddcd10c28729b4d99b5dd7fa8a0d3e78ee","observation_id":"3a8e8e02-fde0-406d-bd56-e7666f4e550c","resolution":{"observed_at":"2026-07-03T10:27:56.334823Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"cited_work":{"arxiv_id":"2509.00328","doi":"10.48550/arxiv.2509.00328","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00328","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mechanistic interpretability for steering vision-language-action models","venue":"ArXiv.org","work_id":"b81aac23-24d1-45f9-aca2-f6f949ee9d09","year":2025},"citing_paper":{"arxiv_id":"2606.26588","last_updated":"2026-06-25T04:20:08Z","snapshot_observed_at":"2026-08-07T09:51:22.326073Z","submitted_at":"2026-06-25T04:20:08Z","title":"Inference-Time Robot Behavior Steering through Physically-Aware Reconfiguration of Task-Structure","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T05:32:52.472573Z"},"links":{"cited_paper":"/paper/2509.00328","citing_paper":"/paper/2606.26588"},"observation_digest":"sha256:2d43b2cfdbc78fc97f976c60acd9df43d37d5f01ff85437eda8b9551d5810cc1","observation_id":"300ac5d0-992f-4578-98d4-3ca098637646","resolution":{"observed_at":"2026-07-04T13:09:50.087802Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"cited_work":{"arxiv_id":"2509.00328","doi":"10.48550/arxiv.2509.00328","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00328","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mechanistic interpretability for steering vision-language-action models","venue":"ArXiv.org","work_id":"b81aac23-24d1-45f9-aca2-f6f949ee9d09","year":2025},"citing_paper":{"arxiv_id":"2606.29201","last_updated":"2026-06-28T05:01:27Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T05:01:27Z","title":"Behavior Uncloning: Distilling Mode Redirection into Policy Weights without Inference-Time Steering","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T07:49:04.825693Z"},"links":{"cited_paper":"/paper/2509.00328","citing_paper":"/paper/2606.29201"},"observation_digest":"sha256:a37b1f691c61d60461282719d75441afc1241242c901ef4a18363bb47c4a04c6","observation_id":"4d00da8f-991c-4342-b34b-a1803124e5a8","resolution":{"observed_at":"2026-06-30T07:54:22.156382Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"cited_work":{"arxiv_id":"2509.00328","doi":"10.48550/arxiv.2509.00328","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00328","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mechanistic interpretability for steering vision-language-action models","venue":"ArXiv.org","work_id":"b81aac23-24d1-45f9-aca2-f6f949ee9d09","year":2025},"citing_paper":{"arxiv_id":"2606.29699","last_updated":"2026-06-29T02:07:17Z","snapshot_observed_at":"2026-07-07T00:03:36.327050Z","submitted_at":"2026-06-29T02:07:17Z","title":"Early Warning Signals for OpenVLA Failure under Visual Distribution Shift","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T06:57:42.414408Z"},"links":{"cited_paper":"/paper/2509.00328","citing_paper":"/paper/2606.29699"},"observation_digest":"sha256:52687af66bc12c299a825828bd3aedb3eb6e7218cdbcf02760112b898bfe9f8d","observation_id":"53d64a06-13d4-4056-a2b2-78e68f1d3a31","resolution":{"observed_at":"2026-06-30T07:04:21.924549Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.00328","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Mechanistic interpretability for steering vision-language-action models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2509.00328","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:bf0797ce01d8f4d2eba696790f5d3fdeacf6d8c58e020c763ce899f94713892a","observation_id":"41a477b1-52f3-4b1e-b019-7872a0c4b39a","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.00328","snapshot_observed_at":"2026-08-01T19:34:24.408268Z","title":"H ¨aon, K","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:24.408268Z"},"links":{"cited_paper":"/paper/2509.00328","citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:af283977906fb798963258ec80b4ab20d1b37ad9bd7235d054e38cf1a0f6ed3e","observation_id":"54089362-2ad1-4a2c-987a-061ef16fd07d","resolution":{"observed_at":"2026-08-01T19:34:24.408268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.00328/citation-record","integrity":"/paper/2509.00328/integrity","json":"/paper/2509.00328/citation-record.json","paper":"/paper/2509.00328"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-05T13:50:17.340438Z","title":"Black, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:17.340438Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:c6eb830f4cbb0620a85f26b764c8ed3ba86fe3c5bf692c329c3799f54e5b9bf8","observation_id":"dedf9934-f427-451f-a357-b1117075386c","resolution":{"observed_at":"2026-08-05T13:50:17.340438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09747","snapshot_observed_at":"2026-08-05T13:50:17.405514Z","title":"Pertsch, K","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:17.405514Z"},"links":{"cited_paper":"/paper/2501.09747","citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:4288e7f342d2ae07b636b1b64badc6dcec936743cce78b90220592aa1494e166","observation_id":"99d155fb-1462-4ecf-86ab-dfdaf40e4073","resolution":{"observed_at":"2026-08-05T13:50:17.405514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20020","last_updated":"2025-03-25T19:02:56Z","snapshot_observed_at":"2026-08-02T07:15:58.798604Z","submitted_at":"2025-03-25T19:02:56Z","title":"Gemini Robotics: Bringing AI into the Physical World","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20020","snapshot_observed_at":"2026-08-05T13:50:17.477053Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:17.477053Z"},"links":{"cited_paper":"/paper/2503.20020","citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:68925703f78ae387e5b4636d44e0a4096db407258e662d1f6b49f7854298b1fe","observation_id":"401dc38c-c838-4297-a56b-5068fe353473","resolution":{"observed_at":"2026-08-05T13:50:17.477053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:50:22.309295Z","title":"Olsson, N","venue":null,"work_id":"7148e101-e234-4216-8731-f97eee3f3f70","year":2022},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:17.550347Z"},"links":{"citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:2eed5e098168458af050bf202559c0739f0f9eedac07359e04bbf141ddfb028e","observation_id":"ae6ec2d6-d770-433b-b446-2ec22f950601","resolution":{"observed_at":"2026-08-05T13:50:22.367472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:50:22.210135Z","title":"Bricken, A","venue":null,"work_id":"fe4b15a5-e116-4435-b806-57a7435c352f","year":2023},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:17.645083Z"},"links":{"citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:e84335e0b93d5b956373b6e1c484bcf937277f3ba2fafa6f91bedfabcb0de8d7","observation_id":"8e17f86b-c056-4103-a2fc-331274c84dc6","resolution":{"observed_at":"2026-08-05T13:50:22.248319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-07-06T16:19:05.495349Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-05T13:50:17.699172Z","title":"Cunningham, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:17.699172Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:1410cf8db028ee04f9beefac335a140841ddcf4764d1da4f1d6967222a761d59","observation_id":"ccea36d1-5389-4076-b65f-069e132101bb","resolution":{"observed_at":"2026-08-05T13:50:17.699172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10965","last_updated":"2025-03-28T01:48:40Z","snapshot_observed_at":"2026-08-08T08:53:29.457485Z","submitted_at":"2025-03-14T00:21:15Z","title":"Auditing language models for hidden objectives","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10965","snapshot_observed_at":"2026-08-05T13:50:17.777613Z","title":"Marks, J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:17.777613Z"},"links":{"cited_paper":"/paper/2503.10965","citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:226e0e664f17d23a39da66d1c53fadf5bfd55b811e78916b91985c2846b65bcd","observation_id":"17683638-5c63-49f4-8d3f-25b356055bbb","resolution":{"observed_at":"2026-08-05T13:50:17.777613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14680","last_updated":"2022-10-12T18:01:23Z","snapshot_observed_at":"2026-08-03T05:22:23.916601Z","submitted_at":"2022-03-28T12:26:00Z","title":"Transformer Feed-Forward Layers Build Predictions by Promoting Concepts in the Vocabulary Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14680","snapshot_observed_at":"2026-08-05T13:50:17.879188Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:17.879188Z"},"links":{"cited_paper":"/paper/2203.14680","citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:e22e39b3951322bca2b1a58214e82944b164b938994f70a3ab7b3f404b0baaed","observation_id":"43ba72b4-688e-4c8f-addf-b0cc2f154b4a","resolution":{"observed_at":"2026-08-05T13:50:17.879188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:50:22.148731Z","title":null,"venue":null,"work_id":"a5526f09-ba8f-4b86-8a48-fab296ede8e0","year":2017},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:17.949865Z"},"links":{"citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:093ac822006eee283c4889f68395b189bb6d96fe2e2d7ff31c5418a63ed09001","observation_id":"8e229f8e-8cb8-41b7-84cd-28cf9b249177","resolution":{"observed_at":"2026-08-05T13:50:22.173272Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:50:22.050139Z","title":"Lindsey, W","venue":null,"work_id":"6b12f0f4-65a5-4a18-af24-034ec7f4c421","year":2025},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:18.004338Z"},"links":{"citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:0f5b5217c16af2491beb6c9e9e8c082f685c6cade2f8eef90a05a80c0754fb21","observation_id":"03539586-64b6-4ef4-9fb6-ea577bfdccf2","resolution":{"observed_at":"2026-08-05T13:50:22.092254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:50:18.065539Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:18.065539Z"},"links":{"citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:026d36a800a901ade5999f0880bc70d00fbdc695fc5d620471ed27b11206c67b","observation_id":"23374a08-6c83-486f-9134-17e2caaecafd","resolution":{"observed_at":"2026-08-05T13:50:18.065539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:50:21.890769Z","title":null,"venue":null,"work_id":"71ca5e9d-b383-4e3f-8729-493ffdcba61d","year":2023},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:18.145489Z"},"links":{"citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:30793e4ccd05a112315966b2025234195cee5aad07a00336fe49aa719950ccfe","observation_id":"b9a49aef-5065-4fa9-a41e-5e0ef4bf6ea9","resolution":{"observed_at":"2026-08-05T13:50:21.933354Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:50:21.778070Z","title":"Pohland and C","venue":null,"work_id":"6d5657ae-7454-4a3d-9676-a8d1f4268b0f","year":2024},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:18.193955Z"},"links":{"citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:2af916a763788ee4e85758146b08559cad0cfc30b83457b47208f4067b5a3008","observation_id":"68c838f9-3fb9-4e9d-9262-b60d53b0c5df","resolution":{"observed_at":"2026-08-05T13:50:21.824882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:50:21.639526Z","title":"Glanois, P","venue":null,"work_id":"5e81ae76-cdce-4a2b-b403-31c199ac3635","year":2024},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:18.239721Z"},"links":{"citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:9c30090faf6b3602485275a98e056e66ba3fdea48ab5b1b205a154d0223160ff","observation_id":"bbac923b-4354-4d25-9aac-4f3993e020eb","resolution":{"observed_at":"2026-08-05T13:50:21.704961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:50:21.542605Z","title":null,"venue":null,"work_id":"d30bec53-3cd5-44dd-9abc-040c498e38bf","year":2024},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:18.386699Z"},"links":{"citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:045ec8ed0c6ce2acb6563c7f1f2ba644792d37e5f91b913dbdc94108335c94eb","observation_id":"b4a92cf3-9894-4102-b829-b2ca9004f722","resolution":{"observed_at":"2026-08-05T13:50:21.610055Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.14913","last_updated":"2021-09-05T17:32:27Z","snapshot_observed_at":"2026-08-07T23:50:29.977330Z","submitted_at":"2020-12-29T19:12:05Z","title":"Transformer Feed-Forward Layers Are Key-Value Memories","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.14913","snapshot_observed_at":"2026-08-05T13:50:18.493376Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:18.493376Z"},"links":{"cited_paper":"/paper/2012.14913","citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:4482d1bfce3e4a7c13a2781cd3abc559e4186ae4be6f648617f59a008873bc60","observation_id":"86766956-e8ae-40b2-8db4-baf2f100bd3b","resolution":{"observed_at":"2026-08-05T13:50:18.493376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-08T01:53:43.555672Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T13:50:18.630035Z","title":"Collaboration, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:18.630035Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:c6d7ca96828370cd6b779edb653ba7de205e34cb3e35b2090315a8c1cab16eda","observation_id":"0d355870-39ec-4cdc-8040-38da78dd0adf","resolution":{"observed_at":"2026-08-05T13:50:18.630035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-05T13:50:18.751597Z","title":"Brohan, N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:18.751597Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:24b192f088ad2605cc262e19af99ca944c2d31efa7c1903dbdae618afcb9ca3e","observation_id":"30f99f6b-5f28-457f-9376-299a076646bb","resolution":{"observed_at":"2026-08-05T13:50:18.751597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:50:21.377407Z","title":null,"venue":null,"work_id":"b68a6145-edb7-4c8a-b965-6c6fd7c9856f","year":2024},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:18.869757Z"},"links":{"citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:e5579d145f1e9caa148d3bb23e4943da4a4975d3c7d12c7857c77518d894fd49","observation_id":"8774c8d3-bd5e-4fa0-b630-bb09dd3ef380","resolution":{"observed_at":"2026-08-05T13:50:21.446745Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07726","last_updated":"2024-10-10T17:28:23Z","snapshot_observed_at":"2026-08-08T07:16:45.596308Z","submitted_at":"2024-07-10T14:57:46Z","title":"PaliGemma: A versatile 3B VLM for transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07726","snapshot_observed_at":"2026-08-05T13:50:18.967190Z","title":"Beyer, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:18.967190Z"},"links":{"cited_paper":"/paper/2407.07726","citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:099fedfda51fdce3ae859eef2e50ad8aac3646255a544cddad56234e6025149c","observation_id":"6ecd7d12-3138-48d2-b0a3-411fd97f8381","resolution":{"observed_at":"2026-08-05T13:50:18.967190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T13:50:19.068750Z","title":"Touvron, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:19.068750Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:96e528eb5dc82110652ffeacf722645eaf928001c65ad35b5b36d51ecfe836e5","observation_id":"b8557c48-2a70-4e02-b973-9a0b7dceae4d","resolution":{"observed_at":"2026-08-05T13:50:19.068750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:50:21.189913Z","title":"Khazatsky, K","venue":null,"work_id":"c477d0f3-e592-42d6-ae89-36c628276904","year":2024},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:19.201947Z"},"links":{"citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:8a1bd2d9f1013219f16a65456dfc00b9b5b1f89e5210ca760e749ce6d231a172","observation_id":"329c2eb6-2d26-486d-86da-201818b4a3bf","resolution":{"observed_at":"2026-08-05T13:50:21.282979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:50:19.270055Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:19.270055Z"},"links":{"citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:51098ee00500fb30a051aefac7d920cb643570047ae3098d270d8ee717b34889","observation_id":"e038a7af-2217-4bc5-b0d3-068c9f87dc7b","resolution":{"observed_at":"2026-08-05T13:50:19.270055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:50:20.936717Z","title":null,"venue":null,"work_id":"e1dd4868-81fe-4483-aad9-e8bf7a87bb87","year":2021},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:19.315544Z"},"links":{"citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:f1d3e3fee88bf0d9776f6ca0980320424608593365c17d8688d40317e820847e","observation_id":"220f1798-8dc3-4665-a8b5-5ecf1a9d98ce","resolution":{"observed_at":"2026-08-05T13:50:21.040180Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-05T13:50:19.351352Z","title":"non-semantic","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:19.351352Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:ffa7cc2d165ce37038e39d130f3ea1164feec054bc624c34ad0958032f27383b","observation_id":"aff1e8f7-6f82-40d7-aa6a-b5ad76e9cc6e","resolution":{"observed_at":"2026-08-05T13:50:19.351352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:50:20.780474Z","title":"To assign meaning to each value vector, we project it into the model’s output token space using the language modeling head, as described in Section 3","venue":null,"work_id":"3d744788-7102-4311-983b-abaa429946bf","year":null},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:19.405912Z"},"links":{"citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:9afb569555968e41cfd868fb51d500e01282deaea061aaeea83dd4774d7e4042","observation_id":"377556f8-069a-40b2-8b9a-0ab58b72df81","resolution":{"observed_at":"2026-08-05T13:50:20.847271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:50:20.550508Z","title":"The full OPEN VLA model contains 352,255 value vectors across all trans- former layers","venue":null,"work_id":"cbb503f3-947f-47a2-948a-c6f07bd030d7","year":null},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:19.442060Z"},"links":{"citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:708d04aa4dca0a2d101866e789af74ac7d6e03594164273865a7ef92e37959a8","observation_id":"f38e0e71-49b4-45a3-aed9-f0b530d27fa7","resolution":{"observed_at":"2026-08-05T13:50:20.674911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:50:20.370114Z","title":"We apply cosine-based k-nearest neighbor (kNN) clustering to these semantic embeddings using the cuML GPU-accelerated library","venue":null,"work_id":"647be482-ed00-43b4-b471-fc6c6c509769","year":null},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:19.467715Z"},"links":{"citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:22ab67592eb09202f93e9fe6274c23277bff9058b0c0b0b0248cb5aa8fd80130","observation_id":"5f1b69fc-0ec5-4cd9-af1a-8b0d67169194","resolution":{"observed_at":"2026-08-05T13:50:20.446544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:50:20.091731Z","title":null,"venue":null,"work_id":"07a78be3-9c63-467d-8d79-674c9368be6b","year":null},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:19.509959Z"},"links":{"citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:b656e21396e614291c7f51d5757bbe6e1c29949ee82fc5609e78039a82a58c22","observation_id":"8e9d2912-1740-4661-86b4-618b5abb202c","resolution":{"observed_at":"2026-08-05T13:50:20.247067Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:50:19.915713Z","title":"place penguin 17 in basket","venue":null,"work_id":"fe041e2e-f5bd-4ee9-9b52-513dd9f61651","year":null},"citing_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T13:50:19.542914Z"},"links":{"citing_paper":"/paper/2509.00328"},"observation_digest":"sha256:73eae7458d8b6519bfc90ed69ecf5b69cc33eadceb9506ab2db2bb9966ffd739","observation_id":"15969075-7633-4de1-886b-8b5af63e0a58","resolution":{"observed_at":"2026-08-05T13:50:19.983808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 11 inbound Pith citation observations for arXiv:2509.00328."}