{"as_of":"2026-08-07T08:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3720380191166eae7b26ecdf789173edcb83e28d4d0677ad98d3af0604d23479","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T12:59:17.093731Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.28083/citation-record","integrity":"/paper/2605.28083/integrity","json":"/paper/2605.28083/citation-record.json","paper":"/paper/2605.28083"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":"2410.24164","doi":"10.48550/arxiv.2410.24164","metadata_source":"pith","pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","venue":"cs.LG","work_id":"f790abdc-a796-482f-a40d-f8ee035ecfc2","year":2024},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:993882c8c7670acad24520fa009b63692cd5fee16101319e622eb9347f3d4893","observation_id":"fc7ceb20-6ecd-49f5-be0b-e2c9160cef0b","resolution":{"observed_at":"2026-06-29T13:03:26.144304Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":"2307.15818","doi":"10.48550/arxiv.2307.15818","metadata_source":"pith","pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","venue":"cs.RO","work_id":"ff438a8a-8003-4fae-9131-acd418b3597b","year":2023},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:ab6398fb274c24a048ef9d03e25d2816bd6f857379f7981c97eede14c7cbd169","observation_id":"2a78f160-4659-4378-a049-5b57e624a28e","resolution":{"observed_at":"2026-06-29T13:03:26.151010Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06111","last_updated":"2025-11-03T11:52:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-09T15:11:13Z","title":"UniVLA: Learning to Act Anywhere with Task-centric Latent Actions","version":3},"cited_work":{"arxiv_id":"2505.06111","doi":"10.48550/arxiv.2505.06111","metadata_source":"pith","pith_arxiv_id":"2505.06111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UniVLA: Learning to Act Anywhere with Task-centric Latent Actions","venue":"cs.RO","work_id":"e05d654d-db73-48f6-9318-381b6798bac9","year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"cited_paper":"/paper/2505.06111","citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:8e1ffa77e994341a03467b33fc6fa1cd9ccde78f1a8a362747869592acafd94b","observation_id":"498cef02-2813-4134-b2bb-49051f7c6c34","resolution":{"observed_at":"2026-06-29T13:03:26.143996Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16719","last_updated":"2026-03-28T16:54:56Z","snapshot_observed_at":"2026-08-07T05:59:39.049027Z","submitted_at":"2025-11-20T18:59:56Z","title":"SAM 3: Segment Anything with Concepts","version":2},"cited_work":{"arxiv_id":"2511.16719","doi":"10.48550/arxiv.2511.16719","metadata_source":"pith","pith_arxiv_id":"2511.16719","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3: Segment Anything with Concepts","venue":"cs.CV","work_id":"4a72a006-2592-4554-aad0-a9c41a9f952d","year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"cited_paper":"/paper/2511.16719","citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:f8c390f59dec64304a795d7084519907adde9c3dba08f04e9c3b62ea64c9dd00","observation_id":"fa10045b-f88c-4830-a299-5d08a7327c92","resolution":{"observed_at":"2026-06-29T13:03:26.129999Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:24.687473+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:24.687473+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T12:59:17.093731Z","title":"IEEE Trans","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:29de2f5cf1675cb7f4bf680f89d98b1437d956c5da9c3848a4cc919154d71ddf","observation_id":"3f93b054-f893-4352-ac2c-3c871bfa823a","resolution":{"observed_at":"2026-06-29T12:59:17.093731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13111","last_updated":"2024-07-18T02:39:31Z","snapshot_observed_at":"2026-07-06T18:48:12.383629Z","submitted_at":"2024-07-18T02:39:31Z","title":"PG-Attack: A Precision-Guided Adversarial Attack Framework Against Vision Foundation Models for Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2407.13111","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13111","snapshot_observed_at":"2026-06-29T13:03:26.154892Z","title":"CoRRabs/2407.13111(2024)","venue":null,"work_id":"aa6eebd2-c9db-4815-a565-bf7d7107852c","year":2024},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"cited_paper":"/paper/2407.13111","citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:347807a50e4be3de1574326cd1b491e082a434c99b5baaba3ee18f9a7129454b","observation_id":"d04067ba-1640-4c3a-bdd0-ff1cd37ef9f3","resolution":{"observed_at":"2026-06-29T13:03:26.156465Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10883","last_updated":"2024-07-08T12:03:14Z","snapshot_observed_at":"2026-08-07T05:57:01.072187Z","submitted_at":"2024-03-16T10:32:24Z","title":"Improving Adversarial Transferability of Vision-Language Pre-training Models through Collaborative Multimodal Interaction","version":2},"cited_work":{"arxiv_id":"2403.10883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.10883","snapshot_observed_at":"2026-07-03T04:37:37.265347Z","title":"Improving adversarial transferability of vision-language pre-training models through collaborative multimodal interaction,","venue":null,"work_id":"3b61e445-d09d-4c97-8533-538b0afc8b5f","year":2024},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"cited_paper":"/paper/2403.10883","citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:17301907c263c6718d1f9551a9d94e77646733ba5b999499e9b674d22ff9e984","observation_id":"a9f6b117-8132-47f9-bb30-3b16c7d3caf4","resolution":{"observed_at":"2026-06-29T13:03:26.170383Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14493","last_updated":"2026-04-13T09:32:05Z","snapshot_observed_at":"2026-08-02T20:44:02.129321Z","submitted_at":"2025-06-17T13:14:55Z","title":"LingoLoop Attack: Trapping MLLMs via Linguistic Context and State Entrapment into Endless Loops","version":3},"cited_work":{"arxiv_id":"2506.14493","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.14493","snapshot_observed_at":"2026-06-29T13:03:26.145467Z","title":"LingoLoop Attack: Trapping MLLMs via Linguistic Context and State Entrapment into Endless Loops","venue":"cs.CL","work_id":"039356ef-3249-45e2-b41b-9777c2a8d3e7","year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"cited_paper":"/paper/2506.14493","citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:4b8b8a4a23b94d47c452a8a6b26262c1a0f3bf0b84982e740883c48a79838715","observation_id":"6cd9cb21-8ef3-410c-b33e-4bfe525cb091","resolution":{"observed_at":"2026-06-29T13:03:26.146749Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.04266","last_updated":"2026-06-08T05:08:44Z","snapshot_observed_at":"2026-08-03T12:18:20.533367Z","submitted_at":"2026-01-07T08:54:31Z","title":"State Backdoor: Towards Stealthy Real-world Poisoning Attack on Vision-Language-Action Model in State Space","version":2},"cited_work":{"arxiv_id":"2601.04266","doi":"10.48550/arxiv.2601.04266","metadata_source":"pith","pith_arxiv_id":"2601.04266","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"State Backdoor: Towards Stealthy Real-world Poisoning Attack on Vision-Language-Action Model in State Space","venue":"cs.CR","work_id":"fec27d16-0564-49de-80b0-f3e9c7f3da1c","year":2026},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"cited_paper":"/paper/2601.04266","citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:8c34b2a15255c79ad2cf15f88e3ea3eb7b81d6415838a0f3403f458f78c09f35","observation_id":"05ea4c42-be25-4d29-9e22-5a8cf73f13e9","resolution":{"observed_at":"2026-06-29T13:03:26.128480Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T12:59:17.093731Z","title":"In: IEEE/CVF International Conference on Computer Vision, ICCV 2023, Paris, France, October 1-6, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:5da272361101d5af6339d20c7b0233b06a78516dec1c9bfd2d6fdca05fd09f77","observation_id":"d6d33fe9-773f-4020-a645-e1ee40b9c94d","resolution":{"observed_at":"2026-06-29T12:59:17.093731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T12:59:17.093731Z","title":"In: Agrawal, P., Kroemer, O., Burgard, W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:9021864358bd52730a55a1e857db5941330ca0bdee3e7dcd0a475b610af81d93","observation_id":"a819f867-4397-40a5-91ef-4d4ed7fa9392","resolution":{"observed_at":"2026-06-29T12:59:17.093731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.19816","doi":"10.48550/arxiv.2506.19816","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CronusVLA: Towards Efficient and Robust Manipulation via Multi-Frame Vision-Language-Action Modeling, October 2025","venue":"arXiv (Cornell University)","work_id":"98421727-12e6-4220-9a07-01a1e8870d40","year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:673cae1d8dcc1ecc3ffda1160f1e00158bbd8f390bfe814caf18966daad4fdc2","observation_id":"cd61e68e-0a21-4a2d-97dd-3439d074fbf4","resolution":{"observed_at":"2026-06-29T13:03:26.125067Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14058","last_updated":"2026-02-13T02:05:15Z","snapshot_observed_at":"2026-08-05T18:48:10.679925Z","submitted_at":"2024-12-18T17:07:20Z","title":"What Matters in Building Vision-Language-Action Models for Generalist Robots","version":4},"cited_work":{"arxiv_id":"2412.14058","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.14058","snapshot_observed_at":"2026-07-09T05:36:01.252344Z","title":"What Matters in Building Vision-Language-Action Models for Generalist Robots","venue":"cs.RO","work_id":"972ba6c7-a312-404e-bd8d-851850b28fc9","year":2024},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"cited_paper":"/paper/2412.14058","citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:45f6fe5a499c3171b16677c803f76ccc43b64bbf290de43a4ac7ab33c2730d11","observation_id":"33aced77-c7df-4dee-bb7d-8c91acfe6590","resolution":{"observed_at":"2026-06-29T13:03:26.136063Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T12:59:17.093731Z","title":"In: The Twelfth International Conference on Learning Representations, ICLR 2024, Vienna, Austria, May 7-11, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:53c6b030c79e3c3193855a9422be780d9239441576499f4e8608d724746733e1","observation_id":"12b193f6-bb27-4c0c-b5c3-d40d47b2ad85","resolution":{"observed_at":"2026-06-29T12:59:17.093731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.03153","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T13:03:26.147828Z","title":"arXiv preprint arXiv:2602.03153 (2026)","venue":null,"work_id":"f45fd92d-b0ed-4ba1-bea9-b5011bb21f49","year":2026},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:e64fed83278727ddd1f513078a608c54fe63886bb6bbc41646c6c20e2d0474c5","observation_id":"4e77dd52-920a-4a3e-8e38-9db4baf3142c","resolution":{"observed_at":"2026-06-29T13:03:26.149186Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T12:59:17.093731Z","title":"In: Oh, A., Naumann, T., Globerson, A., Saenko, K., Hardt, M., Levine, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:8f2f84c3aa265d439c53ac5bca29c11389fb92a08daa8a042077e48cf0260f54","observation_id":"fd7d37ec-a744-42d8-8570-bb0a83e7a31e","resolution":{"observed_at":"2026-06-29T12:59:17.093731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.21192","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T15:18:33.835393Z","title":"C., and Jiang, X","venue":null,"work_id":"07740c81-87b9-49bf-bd80-942358aecd05","year":2026},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:f8da564193892af3bda8120decc3c570963675de248ddfb9a0819a13847b3314","observation_id":"25fa4325-aed4-4ec1-bb28-4de6ea1acee9","resolution":{"observed_at":"2026-06-29T13:03:26.099322Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.10008","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T13:03:26.140427Z","title":"CoRRabs/2511.10008(2025)","venue":null,"work_id":"1be28334-bc3a-4cab-ac3f-e4c69a3883fe","year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:ffc0eb918198ef8c3a65ab312d0cb3d6a6f14387ae45010a15dcdfc7b8d8667e","observation_id":"1f7e54b2-5c03-442c-ad2c-328ff3ff6445","resolution":{"observed_at":"2026-06-29T13:03:26.141674Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T12:59:17.093731Z","title":"In: IEEE/CVF Winter Conference on Applications of Computer Vision, WACV 2022, Waikoloa, HI, USA, January 3-8, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:3f7dfdddf590f5a8fda85a98cd9209f63c149feba00ee20943f5ef873a22bedd","observation_id":"4110fc12-d0c9-43df-9fc3-95fce95733b7","resolution":{"observed_at":"2026-06-29T12:59:17.093731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-07-06T20:26:31.558337Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":"2501.15830","doi":"10.48550/arxiv.2501.15830","metadata_source":"pith","pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","venue":"cs.RO","work_id":"592041b3-3ca2-4836-8dd4-f8095d8a692b","year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:7698fcdbdd3be22a47f9c96c04311b22b1823426254359aec6f840869e7b7663","observation_id":"d3c7df25-1758-4cca-9961-c9d038ba541b","resolution":{"observed_at":"2026-06-29T13:03:26.167618Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T12:59:17.093731Z","title":"IEEE Trans","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:d7164c6a42f2e44276e50777c25ee175809bd3cf63e7ac6d3ac07d914e4b376e","observation_id":"1de37412-1137-4574-a3f0-4a9fc0b4b65d","resolution":{"observed_at":"2026-06-29T12:59:17.093731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T12:59:17.093731Z","title":"In: Tan, J., Toussaint, M., Darvish, K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:d289a5f503dbb7f4d0ef6d5451c24be3dd7a8596ffaa1d408283697bf64df012","observation_id":"92d2dcb1-d590-4646-b1a6-cb920da5e538","resolution":{"observed_at":"2026-06-29T12:59:17.093731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13587","last_updated":"2025-08-01T03:41:06Z","snapshot_observed_at":"2026-07-06T19:53:21.444233Z","submitted_at":"2024-11-18T01:52:20Z","title":"Exploring the Adversarial Vulnerabilities of Vision-Language-Action Models in Robotics","version":4},"cited_work":{"arxiv_id":"2411.13587","doi":"10.48550/arxiv.2411.13587","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.13587","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Exploring the adversarial vulnerabilities of vision- language-action models in robotics, 2025a","venue":null,"work_id":"43cee4dc-7ef4-48ef-9d93-bf25ae46166b","year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"cited_paper":"/paper/2411.13587","citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:542b685eeda4807cdc59be2f730f7fa71a8573ceedd52645f1c47f6950b3e0b0","observation_id":"a99d7194-6c86-452c-861a-5d6e400be804","resolution":{"observed_at":"2026-06-29T13:03:26.125632Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.16645","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T13:03:26.160905Z","title":"arXiv preprint arXiv:2509.16645 , year=","venue":null,"work_id":"6bb7640c-958c-462d-8f41-7eeb0610f13a","year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:515076945e44c4c889b06d64a30c47678f8e2a373c800571c17711c459be47bd","observation_id":"c64b9e1e-110a-40d6-88d7-871ba93f9a17","resolution":{"observed_at":"2026-06-29T13:03:26.162323Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05855","last_updated":"2025-08-09T10:58:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-09T11:25:56Z","title":"DexVLA: Vision-Language Model with Plug-In Diffusion Expert for General Robot Control","version":3},"cited_work":{"arxiv_id":"2502.05855","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.05855","snapshot_observed_at":"2026-07-10T04:16:48.719609Z","title":"DexVLA: Vision-Language Model with Plug-In Diffusion Expert for General Robot Control","venue":"cs.RO","work_id":"3564a757-5726-4b2a-a28e-114a4a467dfb","year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"cited_paper":"/paper/2502.05855","citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:d7a4dbe0b9ab80b50bdfe3e0036b4f600023e416428948cc88e5d531656de1a6","observation_id":"2fa6e2ea-0a2d-458c-afa2-d152495b6cb7","resolution":{"observed_at":"2026-06-29T13:03:26.164912Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T12:59:17.093731Z","title":"IEEE Robotics Autom","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:9189512564474f051e77d3c9015e039856b62aa9ad03b500b3268038b5094fad","observation_id":"9f588c1a-eefb-43eb-b908-5dd965283d76","resolution":{"observed_at":"2026-06-29T12:59:17.093731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.14323","last_updated":"2026-05-31T06:08:19Z","snapshot_observed_at":"2026-08-03T09:36:19.663430Z","submitted_at":"2026-01-20T01:24:17Z","title":"SilentDrift: Exploiting Action Chunking for Stealthy Backdoor Attacks on Vision-Language-Action Models","version":2},"cited_work":{"arxiv_id":"2601.14323","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.14323","snapshot_observed_at":"2026-06-29T13:03:26.152329Z","title":"SilentDrift: Exploiting Action Chunking for Stealthy Backdoor Attacks on Vision-Language-Action Models","venue":"cs.CR","work_id":"3edd9945-33a7-4c7a-888b-5721d1a569b0","year":2026},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"cited_paper":"/paper/2601.14323","citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:132e00a05023780221e12422eb2aeb0e6feb9f1218beadddaaa1a986a7a67104","observation_id":"7119245a-6459-46c1-8cd3-b3aec6713b47","resolution":{"observed_at":"2026-06-29T13:03:26.153788Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.13237","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T13:03:26.157774Z","title":"Haochuan","venue":null,"work_id":"aed67f32-46f5-4457-a40a-f7a4e7d405cb","year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:7dc300fed25d9c23dbcdebc43295c6f40f343860a72dea4472a68739aa3bbd15","observation_id":"54be7d9d-134d-482f-9633-d19fdc544bea","resolution":{"observed_at":"2026-06-29T13:03:26.159449Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.10932","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T13:03:26.116050Z","title":"Zonghuan","venue":null,"work_id":"f1766bb6-d5ab-4eea-b69d-895720e425fb","year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:6ea0e6d4181004370857f9acd72d8358a512d4ea28d64b2d11e63b6b198ea1f3","observation_id":"eb9c157b-cc45-4e77-9151-9580e2d8ea2a","resolution":{"observed_at":"2026-06-29T13:03:26.117531Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T12:59:17.093731Z","title":"In: Vedaldi, A., Bischof, H., Brox, T., Frahm, J","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:287d26ad78d007b7afb6f5bf257f5e4f755c540cc269c2f80636986d038c95d9","observation_id":"ee1feb9c-07e3-420a-91a5-3cfc23b3d1ab","resolution":{"observed_at":"2026-06-29T12:59:17.093731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.17520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:16:48.695703Z","title":"Instructvla: Vision-language-action instruction tuning from understanding to manipulation","venue":null,"work_id":"66890618-d3a5-4d24-b379-ac9f40186769","year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:4c3a3b1a07e013fe9a62dee671b5b10209272110023512f76b21e79d2c4ee805","observation_id":"0a426ccf-11ed-4576-8130-dfe77099d848","resolution":{"observed_at":"2026-06-29T13:03:26.133774Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.03480","last_updated":"2026-04-19T06:23:17Z","snapshot_observed_at":"2026-07-30T14:07:10.544745Z","submitted_at":"2025-03-05T13:16:55Z","title":"SafeVLA: Towards Safety Alignment of Vision-Language-Action Model via Constrained Learning","version":4},"cited_work":{"arxiv_id":"2503.03480","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.03480","snapshot_observed_at":"2026-07-09T12:06:13.613038Z","title":"SafeVLA: Towards Safety Alignment of Vision-Language-Action Model via Constrained Learning","venue":"cs.RO","work_id":"ecd8c6c1-213e-4451-b646-a08e1200e5c3","year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"cited_paper":"/paper/2503.03480","citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:c1ec3193bb97da16c20c37afa461b3c1abd656ef24dec90575447ca6239aeb43","observation_id":"5a893bc2-8dcd-4692-8405-f5e0beec1d54","resolution":{"observed_at":"2026-06-29T13:03:26.146106Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.21663","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T15:18:33.855962Z","title":"Zhang, W","venue":null,"work_id":"9cec4f7c-cc80-4ff2-b847-83ad41141fd1","year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:c15a00b7a7bb0752bbb537482b8e201306fcd3c9c5c5b3d8b2cd806a6190b28f","observation_id":"95d4a10d-1fe9-4c5e-9af6-59096fdc8d07","resolution":{"observed_at":"2026-06-29T13:03:26.156426Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T12:59:17.093731Z","title":"In: Oh, A., Naumann, T., Globerson, A., Saenko, K., Hardt, M., Levine, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:a9694dd68e166f0eb1f74f72250a92f74a8c20d94fe8624a39e6e14095e022b7","observation_id":"d11a3f9e-194e-420b-afbd-b826e75994fc","resolution":{"observed_at":"2026-06-29T12:59:17.093731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.00500","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T13:03:26.150232Z","title":"arXiv preprint arXiv:2602.00500 (2026)","venue":null,"work_id":"250fb6e7-24f6-48c6-a03c-b0867ba14cef","year":2026},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:b3d9c2342cb5e2734e3502431eb68004ad4628922de4d8d697dea178aa252022","observation_id":"3dc86dc8-6a0a-49b4-ada0-ad68d891336e","resolution":{"observed_at":"2026-06-29T13:03:26.151541Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T08:19:31.332132Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":"2505.16640","doi":"10.48550/arxiv.2505.16640","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BadVLA: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":"ArXiv.org","work_id":"31fedaa1-3fa4-4e01-a186-3707310f4db2","year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:8d2939aae56b38576e41007cb24fa6dc6eb9cb878081dcd674112f6b6e8382f3","observation_id":"fd788293-a181-497c-9838-7ed4afb7e6ac","resolution":{"observed_at":"2026-06-29T13:03:26.114953Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.09269","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T13:03:26.137483Z","title":"CoRR abs/2510.09269(2025)","venue":null,"work_id":"dbfc84ee-9e0b-4e72-8c3a-726c2a7d2ca0","year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:e4d44a60da902d6e1c550bfbc088fa8aaf460508a1a75d955f2b1dbc40cc4f1a","observation_id":"44608501-8c98-4b51-8039-d3ebbace07ac","resolution":{"observed_at":"2026-06-29T13:03:26.138838Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19250","last_updated":"2025-02-28T15:17:11Z","snapshot_observed_at":"2026-07-06T20:43:08.913991Z","submitted_at":"2025-02-26T15:56:36Z","title":"ObjectVLA: End-to-End Open-World Object Manipulation Without Demonstration","version":2},"cited_work":{"arxiv_id":"2502.19250","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19250","snapshot_observed_at":"2026-07-04T04:39:34.275917Z","title":"Objectvla: End-to-end open-world ob- ject manipulation without demonstration","venue":null,"work_id":"b72b843a-8daa-4978-8d88-7bbf5dc5f618","year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"cited_paper":"/paper/2502.19250","citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:2043f8bcbb25efd0b0acb0e728f89015d8e8191c0cbae409169dd50f4b7a4ce4","observation_id":"929c1d63-d8d1-4464-8e70-94a99bc65ddf","resolution":{"observed_at":"2026-06-29T13:03:26.158704Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":21,"parse_uncertain":0,"unresolved":11,"verified_exact":6,"verified_fuzzy":0},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2605.28083."}