{"as_of":"2026-08-07T17:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:79d3ee6cb47f544fe82a932e04904bf41b24af09f0426aaaaf242cce1d18025a","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:04:01.363663Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:41:30.013412Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T11:00:38.344567Z","title":"Badvla: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03383","last_updated":"2025-09-03T15:00:28Z","snapshot_observed_at":"2026-08-06T10:29:35.248509Z","submitted_at":"2025-09-03T15:00:28Z","title":"ANNIE: Be Careful of Your Robots","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-05T11:00:38.344567Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2509.03383"},"observation_digest":"sha256:7ac8018edacb90d506e9e5eb16ab7a3c1fa1c37ac7b48230f29b3554f57545dc","observation_id":"5c633738-e24e-4bed-a8b9-d4bf043d77e8","resolution":{"observed_at":"2026-08-05T11:00:38.344567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-03T12:18:22.784748Z","title":"Badvla: To- wards backdoor attacks on vision-language-action models via objective- decoupled optimization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.04266","last_updated":"2026-06-08T05:08:44Z","snapshot_observed_at":"2026-08-07T08:42:06.936507Z","submitted_at":"2026-01-07T08:54:31Z","title":"State Backdoor: Towards Stealthy Real-world Poisoning Attack on Vision-Language-Action Model in State Space","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T12:18:22.784748Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2601.04266"},"observation_digest":"sha256:043a70684939c628d94079702761702880710239dd516574d5cadcac8e9a4fc8","observation_id":"8445cced-2873-4095-b6c0-17dfe7baeed9","resolution":{"observed_at":"2026-08-03T12:18:22.784748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":"2505.16640","doi":"10.48550/arxiv.2505.16640","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BadVLA: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":"ArXiv.org","work_id":"31fedaa1-3fa4-4e01-a186-3707310f4db2","year":2025},"citing_paper":{"arxiv_id":"2602.03433","last_updated":"2026-02-03T11:56:08Z","snapshot_observed_at":"2026-07-06T22:44:18.875334Z","submitted_at":"2026-02-03T11:56:08Z","title":"When control meets large language models: From words to dynamics","version":1},"reference_index":209,"source":"pdf_text","source_observed_at":"2026-05-21T14:52:44.632671Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2602.03433"},"observation_digest":"sha256:7daedceeed81afa99e7cd9c8a8e4265d013c764b7a29600ac44c8dfda491c5e8","observation_id":"2ddeba9e-d2a1-4461-b893-8df29db754f0","resolution":{"observed_at":"2026-05-21T14:54:13.088768Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-07-15T12:42:28.672749Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.08316","last_updated":"2026-07-01T07:09:02Z","snapshot_observed_at":"2026-08-04T04:57:22.852231Z","submitted_at":"2026-03-09T12:38:28Z","title":"SlowBA: An efficiency backdoor attack towards VLM-based GUI agents","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-07-15T12:42:28.672749Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2603.08316"},"observation_digest":"sha256:a154b87c9e3d610e5ba268f31b3658af0240c6e82ef538fb0ae65fd9534cd170","observation_id":"4b4aeceb-78b5-4045-838f-0e0af595e582","resolution":{"observed_at":"2026-07-15T12:42:28.672749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-07-13T19:50:50.950451Z","title":"Badvla: Towards backdoor attacks on vision- language-action models via objective-decoupled opti- mization.arXiv preprint arXiv:2505.16640, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.23117","last_updated":"2026-06-01T08:02:23Z","snapshot_observed_at":"2026-08-04T07:57:16.483761Z","submitted_at":"2026-03-24T12:14:12Z","title":"TRAP: Hijacking VLA CoT-Reasoning via Adversarial Patches","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T19:50:50.950451Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2603.23117"},"observation_digest":"sha256:3782aa60d2701981ef0121ef8a7b0c692b96907426e6b437323cd01726ca9047","observation_id":"e87022be-e0b8-4987-a14e-599b551b4c92","resolution":{"observed_at":"2026-07-13T19:50:50.950451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":"2505.16640","doi":"10.48550/arxiv.2505.16640","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BadVLA: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":"ArXiv.org","work_id":"31fedaa1-3fa4-4e01-a186-3707310f4db2","year":2025},"citing_paper":{"arxiv_id":"2603.24935","last_updated":"2026-04-07T10:20:22Z","snapshot_observed_at":"2026-08-06T10:57:09.113964Z","submitted_at":"2026-03-26T01:56:01Z","title":"SABER: A Stealthy Agentic Black-Box Attack Framework for Vision-Language-Action Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-15T01:06:42.421062Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2603.24935"},"observation_digest":"sha256:2da3b7580380d336f9a792402c2e6b2772d6aa23b8ff15a17894f2b1c1429921","observation_id":"f3a24cca-98f1-4f9b-bf74-c7cb9431a1f3","resolution":{"observed_at":"2026-05-15T01:08:25.704830Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":"2505.16640","doi":"10.48550/arxiv.2505.16640","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BadVLA: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":"ArXiv.org","work_id":"31fedaa1-3fa4-4e01-a186-3707310f4db2","year":2025},"citing_paper":{"arxiv_id":"2604.09651","last_updated":"2026-03-30T03:54:04Z","snapshot_observed_at":"2026-08-07T01:26:00.994535Z","submitted_at":"2026-03-30T03:54:04Z","title":"FlowHijack: A Dynamics-Aware Backdoor Attack on Flow-Matching Vision-Language-Action Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-14T22:20:35.818770Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2604.09651"},"observation_digest":"sha256:c2e13a7d1cab7e37c5a91851d28aa6de5782b6f51263d2f3cac49358fd8e1698","observation_id":"d5bd4e92-2269-4073-96d1-69c7c13de471","resolution":{"observed_at":"2026-05-14T22:23:03.896495Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":"2505.16640","doi":"10.48550/arxiv.2505.16640","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BadVLA: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":"ArXiv.org","work_id":"31fedaa1-3fa4-4e01-a186-3707310f4db2","year":2025},"citing_paper":{"arxiv_id":"2605.01950","last_updated":"2026-05-03T16:19:45Z","snapshot_observed_at":"2026-07-06T23:15:07.159340Z","submitted_at":"2026-05-03T16:19:45Z","title":"TRAP: Tail-aware Ranking Attack for World-Model Planning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:45.407680Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2605.01950"},"observation_digest":"sha256:3b25d95590b8099e8f474b0f9af90dca1d365b58f4bfa689a7450ca9757c7269","observation_id":"221b7a16-6038-42fd-9a90-802cc48f4b81","resolution":{"observed_at":"2026-05-11T10:56:05.031698Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":"2505.16640","doi":"10.48550/arxiv.2505.16640","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BadVLA: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":"ArXiv.org","work_id":"31fedaa1-3fa4-4e01-a186-3707310f4db2","year":2025},"citing_paper":{"arxiv_id":"2605.07110","last_updated":"2026-05-08T01:38:46Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:38:46Z","title":"Securing Computer-Use Agents: A Unified Architecture-Lifecycle Framework for Deployment-Grounded Reliability","version":1},"reference_index":157,"source":"pdf_text","source_observed_at":"2026-05-11T01:15:19.239355Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2605.07110"},"observation_digest":"sha256:cae14ec481002187bedfa75e6ecab4e9666a9808b3e09a5bf6336bbc640a0238","observation_id":"ac84a3ec-5b62-4b10-9e0c-e41c5fef3c6a","resolution":{"observed_at":"2026-05-11T04:35:56.617959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":"2505.16640","doi":"10.48550/arxiv.2505.16640","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BadVLA: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":"ArXiv.org","work_id":"31fedaa1-3fa4-4e01-a186-3707310f4db2","year":2025},"citing_paper":{"arxiv_id":"2605.09005","last_updated":"2026-05-09T15:44:19Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T15:44:19Z","title":"Towards Backdoor-Based Ownership Verification for Vision-Language-Action Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-12T02:29:34.973993Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2605.09005"},"observation_digest":"sha256:63268e2c9abfeb2f7c6241f8e1c8ebec085ef2c03f425b28c5cf2d274143e896","observation_id":"35ecd89a-7daf-4a65-b36a-ee6655a4bc4c","resolution":{"observed_at":"2026-05-12T07:36:36.469829Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":"2505.16640","doi":"10.48550/arxiv.2505.16640","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BadVLA: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":"ArXiv.org","work_id":"31fedaa1-3fa4-4e01-a186-3707310f4db2","year":2025},"citing_paper":{"arxiv_id":"2605.28083","last_updated":"2026-05-27T07:38:16Z","snapshot_observed_at":"2026-07-06T23:37:40.695655Z","submitted_at":"2026-05-27T07:38:16Z","title":"VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T12:59:17.093731Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2605.28083"},"observation_digest":"sha256:e2b1ffb57c2d567450f341881f48d0b0f8b210272840fffb5877cdde3965c4dc","observation_id":"fd788293-a181-497c-9838-7ed4afb7e6ac","resolution":{"observed_at":"2026-06-29T13:03:26.114953Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":"2505.16640","doi":"10.48550/arxiv.2505.16640","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BadVLA: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":"ArXiv.org","work_id":"31fedaa1-3fa4-4e01-a186-3707310f4db2","year":2025},"citing_paper":{"arxiv_id":"2605.29114","last_updated":"2026-05-27T21:21:37Z","snapshot_observed_at":"2026-07-06T23:38:37.178378Z","submitted_at":"2026-05-27T21:21:37Z","title":"ReasonBreak: Probing Vulnerabilities in Reasoning-Enabled Vision-Language-Action Models for Autonomous Driving","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-29T11:10:46.269185Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2605.29114"},"observation_digest":"sha256:801b324d6e1529618044329a308a778eb309cdc4432b2b8a9090622bd17c9ddb","observation_id":"e70e0a67-6834-4e9b-bb40-d070aae3053d","resolution":{"observed_at":"2026-06-29T11:13:20.755147Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":"2505.16640","doi":"10.48550/arxiv.2505.16640","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BadVLA: Towards backdoor attacks on vision- language-action models via objective-decoupled optimization","venue":"ArXiv.org","work_id":"31fedaa1-3fa4-4e01-a186-3707310f4db2","year":2025},"citing_paper":{"arxiv_id":"2606.09499","last_updated":"2026-06-08T13:50:31Z","snapshot_observed_at":"2026-08-04T01:38:32.249378Z","submitted_at":"2026-06-08T13:50:31Z","title":"Targeting World Models to Compromise Robot Learning Pipelines","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-27T16:05:01.264700Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2606.09499"},"observation_digest":"sha256:037f2cff94d9250e353a8486f04cb070b59126515664424060c08f22bf8dd6ff","observation_id":"700ce834-2bac-42a9-a358-ec7a2c49600f","resolution":{"observed_at":"2026-06-27T16:41:03.723593Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-07-11T21:22:51.640124Z","title":"arXiv preprint arXiv:2505.16640 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04146","last_updated":"2026-07-05T07:14:56Z","snapshot_observed_at":"2026-08-06T20:11:09.521301Z","submitted_at":"2026-07-05T07:14:56Z","title":"!Imperio, smolVLA: The Implications of Data Poisoning on Open Source Robotics","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-11T21:22:51.640124Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2607.04146"},"observation_digest":"sha256:475bb4fdf62f2766cd59d43c46230ad26c8f7e570ec3d2d98f1b0d445b8a3c1e","observation_id":"e64dd588-8f01-44fb-b2d0-6c771f528b27","resolution":{"observed_at":"2026-07-11T21:22:51.640124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-03T12:25:33.857073Z","title":"2505.16640 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29169","last_updated":"2026-07-31T08:47:57Z","snapshot_observed_at":"2026-08-07T17:21:06.946865Z","submitted_at":"2026-07-31T08:47:57Z","title":"ActFovea: Runtime Safeguarding for VLA Policies via Spatiotemporal Visual-Action Consistency","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-03T12:25:33.857073Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2607.29169"},"observation_digest":"sha256:7b47d878c32ac58342caa08a36c2ca8f21179f40f8f2bf51883be1df83fc2a22","observation_id":"a1f0309d-e2ca-4514-8d06-6260c49e2391","resolution":{"observed_at":"2026-08-03T12:25:33.857073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16640","snapshot_observed_at":"2026-08-06T00:41:30.013412Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01028","last_updated":"2026-08-02T06:06:28Z","snapshot_observed_at":"2026-08-07T17:25:43.376608Z","submitted_at":"2026-08-02T06:06:28Z","title":"VLAGuard: A Framework for Evaluating and Mitigating Physical Attention Hijacking in Vision-Language-Action Robots within Wireless Sensor Networks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T00:41:30.013412Z"},"links":{"cited_paper":"/paper/2505.16640","citing_paper":"/paper/2608.01028"},"observation_digest":"sha256:780ef4413b44c80f5ee21f96a89559e4a536704fff9729ddf4d067cb07c45e2f","observation_id":"a83ab1fa-054d-4420-abac-7bec8235f93e","resolution":{"observed_at":"2026-08-06T00:41:30.013412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.16640/citation-record","integrity":"/paper/2505.16640/integrity","json":"/paper/2505.16640/citation-record.json","paper":"/paper/2505.16640"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-07T15:03:57.978563Z","title":"π0: A vision-language-action flow model for general robot control, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:57.978563Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:05cd9687a7604074d138162f7b70df5be154b2defd9dd85a24bcf8001741fb61","observation_id":"bcd4ab95-aa11-431d-8cda-622ee9854b89","resolution":{"observed_at":"2026-08-07T15:03:57.978563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-07T15:03:58.041901Z","title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.041901Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:453bf432bc8c21bfca1fa1bd93f99b8f70975644f152c84b6983d86e7d6bdb71","observation_id":"0da2bfcf-eea7-4170-ac2a-cc5786227889","resolution":{"observed_at":"2026-08-07T15:03:58.041901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18565","last_updated":"2023-05-29T18:58:38Z","snapshot_observed_at":"2026-08-07T07:27:51.369423Z","submitted_at":"2023-05-29T18:58:38Z","title":"PaLI-X: On Scaling up a Multilingual Vision and Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18565","snapshot_observed_at":"2026-08-07T15:03:58.109664Z","title":"Pali-x: On scaling up a multilingual vision and language model, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.109664Z"},"links":{"cited_paper":"/paper/2305.18565","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:2ddb1944c37553513c9d7229a9147c65d25cf5467ddb4d413242ab186c23250d","observation_id":"caf71072-ee0c-47d9-b2ed-9d727d5ea4dc","resolution":{"observed_at":"2026-08-07T15:03:58.109664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05526","last_updated":"2017-12-15T04:26:26Z","snapshot_observed_at":"2026-07-06T06:14:30.795326Z","submitted_at":"2017-12-15T04:26:26Z","title":"Targeted Backdoor Attacks on Deep Learning Systems Using Data Poisoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05526","snapshot_observed_at":"2026-08-07T15:03:58.176671Z","title":"Targeted backdoor attacks on deep learning systems using data poisoning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.176671Z"},"links":{"cited_paper":"/paper/1712.05526","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:21a5781869fa2e505eb10b4644a4b47755813e29ce7f830cf64fb1ea4df5e8cd","observation_id":"d6f1e72d-c833-452f-9469-6cc5f7bd23a6","resolution":{"observed_at":"2026-08-07T15:03:58.176671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:58.256301Z","title":"Manipulation facing threats: Evaluating physical vulnerabilities in end-to-end vision language action models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.256301Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:9077486d9006bc76d8776064873d15aa1d08abfcd4061977bdead650c87b21a8","observation_id":"1876874c-b6bf-4318-9732-b2ae36fe931b","resolution":{"observed_at":"2026-08-07T15:03:58.256301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-07T15:03:58.346357Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.346357Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:9027589a0c0ca917f3832464a05fa079620b33b67ae8a2a050e9f8901c158cca","observation_id":"8dad1db0-5b45-49d9-9e85-76110536429b","resolution":{"observed_at":"2026-08-07T15:03:58.346357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03378","last_updated":"2023-03-06T18:58:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-06T18:58:06Z","title":"PaLM-E: An Embodied Multimodal Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03378","snapshot_observed_at":"2026-08-07T15:03:58.461263Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.461263Z"},"links":{"cited_paper":"/paper/2303.03378","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:851514403b9686dad01c65a7cbe589bed0761d6041c390744ece04917939638c","observation_id":"b8759b5b-c83c-4f82-b525-f719cab5894d","resolution":{"observed_at":"2026-08-07T15:03:58.461263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13396","last_updated":"2021-09-27T23:42:12Z","snapshot_observed_at":"2026-07-06T11:51:58.310046Z","submitted_at":"2021-09-27T23:42:12Z","title":"Bridge Data: Boosting Generalization of Robotic Skills with Cross-Domain Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13396","snapshot_observed_at":"2026-08-07T15:03:58.528602Z","title":"Bridge data: Boosting generalization of robotic skills with cross-domain datasets","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.528602Z"},"links":{"cited_paper":"/paper/2109.13396","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:361f32c4e058e88afbd79218b011e5c94544e0326c793aafd868afa5e42466b9","observation_id":"5d5141ef-26ee-4ae7-867e-9ef64731601a","resolution":{"observed_at":"2026-08-07T15:03:58.528602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.00595","last_updated":"2023-09-26T10:47:35Z","snapshot_observed_at":"2026-07-06T15:49:23.374270Z","submitted_at":"2023-07-02T15:33:31Z","title":"RH20T: A Comprehensive Robotic Dataset for Learning Diverse Skills in One-Shot","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.00595","snapshot_observed_at":"2026-08-07T15:03:58.569221Z","title":"Rh20t: A comprehensive robotic dataset for learning diverse skills in one-shot","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.569221Z"},"links":{"cited_paper":"/paper/2307.00595","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:4f983f2620a61d6a9fda4a29a838ca8984ed4c4fa37c3bb351006db2d33603a0","observation_id":"fa4830ef-b66a-4cd3-8da9-0cd4010c3092","resolution":{"observed_at":"2026-08-07T15:03:58.569221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:05.019561Z","title":"Towards artificial general intelligence via a multimodal foundation model","venue":null,"work_id":"da510889-d24c-4441-a8be-0c6a70051477","year":2022},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.611596Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:43c73ac8dbb7c9274ab196f163068825ff09caf77cf345dc761aa8a8c40703aa","observation_id":"700e6b9b-3c97-4f82-b910-fe39f8679dfb","resolution":{"observed_at":"2026-08-07T15:04:05.110305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:04.846513Z","title":"Foundation models in robotics: 11 Applications, challenges, and the future","venue":null,"work_id":"84d8d153-5c2d-4bd7-97a4-d47f54973501","year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.664521Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:60b6a2272ed9c911e30606a512e3e4b39d5eb21b7c1dd02a700515a91276832f","observation_id":"1e9a8a95-a170-49b1-b0d3-a81e517bf936","resolution":{"observed_at":"2026-08-07T15:04:04.960375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:04.650559Z","title":"Robustness of learning from task instructions, 2023","venue":null,"work_id":"4f0051f4-1b0e-4209-944e-e99530db4fa4","year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.731475Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:b544dd4df0b411f6c263fb4d3fa771e93aa80a4c638b12dca62f57da2bdd089b","observation_id":"1babccfb-e2e0-42ae-8095-26a5f72b24e7","resolution":{"observed_at":"2026-08-07T15:04:04.769333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:58.824022Z","title":"Badnets: Evaluating backdooring attacks on deep neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.824022Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:704c9019ab2b829e4de98b797d61dec0e9cbc857bb4b34923f6c4cac35e0e8ee","observation_id":"7c544824-a1e1-437e-8832-4d7414e69c4c","resolution":{"observed_at":"2026-08-07T15:03:58.824022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15863","last_updated":"2025-05-20T09:42:11Z","snapshot_observed_at":"2026-07-06T19:36:58.878434Z","submitted_at":"2024-10-21T10:43:49Z","title":"Task-oriented Robotic Manipulation with Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15863","snapshot_observed_at":"2026-08-07T15:03:58.874940Z","title":"Task-oriented robotic manipulation with vision language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.874940Z"},"links":{"cited_paper":"/paper/2410.15863","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:3441be4291c6ad9fc0d0059a2b3c1f4e9cd39355f3e2b33ab87d0d54c5f8f2f8","observation_id":"415a7332-e1c7-4c9e-bba3-8a5e67b1e9b3","resolution":{"observed_at":"2026-08-07T15:03:58.874940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05821","last_updated":"2024-12-08T06:54:43Z","snapshot_observed_at":"2026-07-06T19:47:38.708013Z","submitted_at":"2024-11-04T18:01:34Z","title":"Benchmarking Vision, Language, & Action Models on Robotic Learning Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05821","snapshot_observed_at":"2026-08-07T15:03:58.912326Z","title":"Benchmarking vision, language, & action models on robotic learning tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.912326Z"},"links":{"cited_paper":"/paper/2411.05821","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:2c99e7db18cab692fc5213f3302fc01de49f5c6ae2d348201a0168223b3ca553","observation_id":"0900040f-a961-4724-a701-f732cf3c5436","resolution":{"observed_at":"2026-08-07T15:03:58.912326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:04.469346Z","title":"The franka emika robot: A reference platform for robotics research and education","venue":null,"work_id":"beee7160-eca0-4208-b0d1-9510ceae0cce","year":2022},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.005600Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:53ff468d4cfffe5b5d135d75a2de2a1e46e5a05608949c63551d309a552c89ff","observation_id":"34ba4f44-e389-4a18-b088-ed238258cc45","resolution":{"observed_at":"2026-08-07T15:04:04.539478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-07T15:03:59.101453Z","title":"Openvla: An open-source vision-language-action model, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.101453Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:3ad74312b0e6337d2be6f8806ffa0046702e9f4f8c81f3e401f4f953452e5f9f","observation_id":"57c5ae31-779c-4aaa-8a3c-dd2ea56b6545","resolution":{"observed_at":"2026-08-07T15:03:59.101453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07283","last_updated":"2024-10-09T11:01:29Z","snapshot_observed_at":"2026-08-02T17:12:52.352951Z","submitted_at":"2024-10-09T11:01:29Z","title":"Prompt Infection: LLM-to-LLM Prompt Injection within Multi-Agent Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07283","snapshot_observed_at":"2026-08-07T15:03:59.150301Z","title":"Prompt infection: Llm-to-llm prompt injection within multi- agent systems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.150301Z"},"links":{"cited_paper":"/paper/2410.07283","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:989ebb9391ad270616aaed328d9b4e598a8687fd13fd840554bc4ce6d21027c8","observation_id":"524a9c13-ddf4-4caa-905b-d93d6a0c7822","resolution":{"observed_at":"2026-08-07T15:03:59.150301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01378","last_updated":"2024-02-05T03:46:00Z","snapshot_observed_at":"2026-07-31T21:45:51.138808Z","submitted_at":"2023-11-02T16:34:33Z","title":"Vision-Language Foundation Models as Effective Robot Imitators","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01378","snapshot_observed_at":"2026-08-07T15:03:59.182171Z","title":"Vision-language foundation models as effective robot imitators","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.182171Z"},"links":{"cited_paper":"/paper/2311.01378","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:ea3c3d6a6229d9ae7f30b88b10a43f137e232ec1241a3eebdbc3b73e55c97a75","observation_id":"1b16272f-66ac-4e50-a783-e906c8945fd4","resolution":{"observed_at":"2026-08-07T15:03:59.182171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:04.278214Z","title":"Backdoor learning: A survey","venue":null,"work_id":"93bd6e11-0730-48b7-ba63-bc50a6acf844","year":2022},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.262720Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:82b31c366f2b973b7d93a94592c191a28704ccf95ac07d0e09e5a1ff0db54f48","observation_id":"39a6566d-fffd-4e5d-a300-6cddec5e9fe4","resolution":{"observed_at":"2026-08-07T15:04:04.369314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:04.136080Z","title":"Vl-trojan: Multimodal instruction backdoor attacks against autoregressive visual language models","venue":null,"work_id":"4f5e4137-8688-4753-ba50-1099cf6face9","year":2025},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.330611Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:bb26d7457682918850dea5cf79364a903d8bc3ea5c97c298d7eebd04d1891f8c","observation_id":"9bacaf4a-2350-44d8-966c-dc4cb939dd20","resolution":{"observed_at":"2026-08-07T15:04:04.201840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18844","last_updated":"2024-12-16T06:59:33Z","snapshot_observed_at":"2026-07-06T18:37:43.309281Z","submitted_at":"2024-06-27T02:31:03Z","title":"Revisiting Backdoor Attacks against Large Vision-Language Models from Domain Shift","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18844","snapshot_observed_at":"2026-08-07T15:03:59.401319Z","title":"Revisiting backdoor attacks against large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.401319Z"},"links":{"cited_paper":"/paper/2406.18844","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:978dc0666b202c3cbf8cf62d5aab9a67d1a45adb8b4303aa783d7de7fb939a37","observation_id":"615a5c13-2769-45a7-90b7-6efda48fc19f","resolution":{"observed_at":"2026-08-07T15:03:59.401319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-07T15:03:59.489710Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.489710Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:c09ebb09499b49f743bde5865849a7b3137ec5728ce127f3361fdf1a57c626f1","observation_id":"fa7bef9c-947b-4452-8b7a-787d949aa26a","resolution":{"observed_at":"2026-08-07T15:03:59.489710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:59.574527Z","title":"Libero: Benchmarking knowledge transfer for lifelong robot learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.574527Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:5638262940908df8d54e1b8cdf2342dbb6adcaa2b87b6af1c43d994c9ce24f4b","observation_id":"2f3c0a21-023d-421b-a14a-80048aff993f","resolution":{"observed_at":"2026-08-07T15:03:59.574527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07403","last_updated":"2024-07-12T03:58:05Z","snapshot_observed_at":"2026-08-07T09:29:22.417640Z","submitted_at":"2024-07-10T06:57:58Z","title":"A Survey of Attacks on Large Vision-Language Models: Resources, Advances, and Future Trends","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07403","snapshot_observed_at":"2026-08-07T15:03:59.647228Z","title":"A survey of attacks on large vision-language models: Resources, advances, and future trends, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.647228Z"},"links":{"cited_paper":"/paper/2407.07403","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:f7ca7a4750600bd80b45f5050c96006052a819503bf48b6ce86248e30ef3ff7b","observation_id":"dc243864-cd91-4efc-9c81-290fc99b70c8","resolution":{"observed_at":"2026-08-07T15:03:59.647228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:59.707899Z","title":"Robomamba: Efficient vision- language-action model for robotic reasoning and manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.707899Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:8b3db7c8eb7db78fb78205317363409df3f6430f1b20ca52a16eea8fddc33c2c","observation_id":"3269f884-48f7-41ae-ac89-246019cf1dac","resolution":{"observed_at":"2026-08-07T15:03:59.707899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09047","last_updated":"2024-10-11T17:59:31Z","snapshot_observed_at":"2026-07-06T19:31:57.906994Z","submitted_at":"2024-10-11T17:59:31Z","title":"Unraveling and Mitigating Safety Alignment Degradation of Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09047","snapshot_observed_at":"2026-08-07T15:03:59.747451Z","title":"Unraveling and mitigating safety alignment degradation of vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.747451Z"},"links":{"cited_paper":"/paper/2410.09047","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:09d5e385000660727153c68d7314c5013ca2499c4d5a1b3b204679af1beb1787","observation_id":"ec1ad98f-36f4-4d05-bb88-d24723940128","resolution":{"observed_at":"2026-08-07T15:03:59.747451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:03.961223Z","title":"Friendly noise against adversarial noise: a powerful defense against data poisoning attack","venue":null,"work_id":"6e91a2e7-d4ab-4b35-b98e-3f7b4424f37c","year":2022},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.788553Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:bca2eee5731782842ff20b369f56320786c158583f2e6035c32df2e21e38cf00","observation_id":"e8caa19c-53de-4456-8fd3-a3b8c322e301","resolution":{"observed_at":"2026-08-07T15:04:04.080009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13581","last_updated":"2024-05-22T12:21:27Z","snapshot_observed_at":"2026-08-07T15:03:51.692003Z","submitted_at":"2024-05-22T12:21:27Z","title":"Safety Alignment for Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13581","snapshot_observed_at":"2026-08-07T15:03:59.863053Z","title":"Safety alignment for vision language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.863053Z"},"links":{"cited_paper":"/paper/2405.13581","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:8da9db1a843f6adbb324f25165e72f5718daf44a4b70713af6cd1d6697a79be8","observation_id":"c7dbf271-07ba-4189-9537-d477baeae198","resolution":{"observed_at":"2026-08-07T15:03:59.863053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:03.778883Z","title":"Trojvlm: Backdoor attack against vision language models","venue":null,"work_id":"5bb8de0f-529c-4c6a-af2a-b22cdcfa1b9c","year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:59.929180Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:ed2726570dff722fb2d037d5d7fc698adba917f6b0bcc977e9f605271433e6fb","observation_id":"ac2637ee-58ea-4bbd-8dc2-b760e3c7c66d","resolution":{"observed_at":"2026-08-07T15:04:03.855423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:03.522203Z","title":"A survey on vision-language-action models for embodied ai, 2025","venue":null,"work_id":"e2da1348-6ff0-4c48-b1ef-b88e48a5f273","year":2025},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.015562Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:ef48cb4b084a37692f2ec7a43d5834d60a8e1464df7845b4de66735dade0ee55","observation_id":"f2704314-95ca-42b1-9d9c-5ad8d84bda0d","resolution":{"observed_at":"2026-08-07T15:04:03.608176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13034","last_updated":"2024-06-05T21:47:37Z","snapshot_observed_at":"2026-08-02T03:24:21.537191Z","submitted_at":"2024-05-16T14:20:30Z","title":"Autonomous Workflow for Multimodal Fine-Grained Training Assistants Towards Mixed Reality","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13034","snapshot_observed_at":"2026-08-07T15:04:00.079070Z","title":"Autonomous workflow for multimodal fine-grained training assistants towards mixed reality","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.079070Z"},"links":{"cited_paper":"/paper/2405.13034","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:9b9947954c4d0bba7ffa6e01f343f4cde3f4d04bdff48ba729d342af047ca88f","observation_id":"ba2fa290-d44a-49bc-aab9-5a80cbf82ff6","resolution":{"observed_at":"2026-08-07T15:04:00.079070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-07-06T20:26:31.558337Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-08-07T15:04:00.141487Z","title":"Spatialvla: Exploring spatial representations for visual-language-action model, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.141487Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:b9a429e69d859e73991b6c79aac63bc5704b51bb16c752f6f4d31545e70b9770","observation_id":"60cc8b52-68a4-4666-9617-aa661226dc9e","resolution":{"observed_at":"2026-08-07T15:04:00.141487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:03.252688Z","title":"Certified defenses for data poisoning attacks","venue":null,"work_id":"fd6d81a2-394a-4eba-81f2-495cee2a2afe","year":2017},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.216614Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:aebcbc31d328e4196186b3ecf556bf4d56594222fa7871416b5ab23c37953a99","observation_id":"cbdcede5-0c6f-473b-a374-a3c41c6ad53a","resolution":{"observed_at":"2026-08-07T15:04:03.348852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12213","last_updated":"2024-05-26T19:55:26Z","snapshot_observed_at":"2026-07-06T18:16:51.116432Z","submitted_at":"2024-05-20T17:57:01Z","title":"Octo: An Open-Source Generalist Robot Policy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12213","snapshot_observed_at":"2026-08-07T15:04:00.287943Z","title":"Octo: An open-source generalist robot policy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.287943Z"},"links":{"cited_paper":"/paper/2405.12213","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:f9877a9282975532248a52ad4e2c4f93da9d7638488cffcd11fd21ca5c434529","observation_id":"b4baf0c2-5b84-42fa-bdc9-284192defb98","resolution":{"observed_at":"2026-08-07T15:04:00.287943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T15:04:00.372988Z","title":"Llama 2: Open foundation and fine-tuned chat models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.372988Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:5c5a72161c503389564457f710db0704e9ef04d3a45545e66e851e6b2e1c9171","observation_id":"e2bb5bd9-fa9b-417b-9d4d-5bdc2155af29","resolution":{"observed_at":"2026-08-07T15:04:00.372988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:03.078042Z","title":"Exploring the adversarial vulnerabilities of vision-language-action models in robotics, 2025","venue":null,"work_id":"8f8ad386-b874-493b-a547-27d10b9446f6","year":2025},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.454391Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:0e077e80cc82ea9efaa1e5aa808f45952a9664bb5b33f70cbf7ab325bfd7f7bf","observation_id":"5bc2d187-336b-479d-bbe8-a09b8aaa988f","resolution":{"observed_at":"2026-08-07T15:04:03.176163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:02.867648Z","title":"Invisible black-box backdoor attack against deep cross-modal hashing retrieval","venue":null,"work_id":"ac9a4806-9e96-4a48-9973-3eaedb69afef","year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.542534Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:40194e968f679e5d7f07ce93126c89102e33ea8c403b2234faf5d983e3700231","observation_id":"3b51d84d-c8a8-459e-953b-640e488347c7","resolution":{"observed_at":"2026-08-07T15:04:02.959518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:00.592104Z","title":"Trojanrobot: Physical-world backdoor attacks against vlm-based robotic manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.592104Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:b27c4f59bf373684c930ca56401d58dfa53d0b225a2cfdfcc55c9405d60d776b","observation_id":"e6a0e3b1-ca48-4bdf-94ea-3d618716c3cf","resolution":{"observed_at":"2026-08-07T15:04:00.592104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01886","last_updated":"2024-06-26T03:29:50Z","snapshot_observed_at":"2026-08-03T09:13:22.955433Z","submitted_at":"2023-12-04T13:40:05Z","title":"InstructTA: Instruction-Tuned Targeted Attack for Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01886","snapshot_observed_at":"2026-08-07T15:04:00.652092Z","title":"Instructta: Instruction- tuned targeted attack for large vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.652092Z"},"links":{"cited_paper":"/paper/2312.01886","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:35018f001067a87cb75187122ef5ed2ff72e3b3c8226460235a7f04560a65d8d","observation_id":"391293fe-2ed3-40e4-a08e-054d6f949b27","resolution":{"observed_at":"2026-08-07T15:04:00.652092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:02.670803Z","title":"Adversarial attacks on multimodal agents","venue":null,"work_id":"1118f210-84c5-4ea9-820a-16aa15ee04d4","year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.724979Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:ac2bab794ffffae4ec6183a8dd3aea58e04e820f63949c39b4d2558d5003ba8f","observation_id":"4cd00f41-373c-4196-b055-82c48e1cd5e2","resolution":{"observed_at":"2026-08-07T15:04:02.738757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12814","last_updated":"2025-02-04T20:02:17Z","snapshot_observed_at":"2026-07-06T18:33:07.118735Z","submitted_at":"2024-06-18T17:32:48Z","title":"Dissecting Adversarial Robustness of Multimodal LM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12814","snapshot_observed_at":"2026-08-07T15:04:00.833689Z","title":"Dissecting adversarial robustness of multimodal lm agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.833689Z"},"links":{"cited_paper":"/paper/2406.12814","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:4e644e879601fe500e4020b56a36eb1ca12f6b73f40cf8f69c8021d498474f6a","observation_id":"d82ac1d1-7e89-4d3d-98e7-8fdd42d13fa1","resolution":{"observed_at":"2026-08-07T15:04:00.833689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:02.455199Z","title":"Adversarial t-shirt! evading person detectors in a physical world,","venue":null,"work_id":"4f0cd836-2553-4de8-80a2-489fedc361f0","year":null},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.927104Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:092d8197a217ae8bff6fd0d25956891551e12424b0e8fb3cec27f1eb28d99db6","observation_id":"93a583b2-3863-44a0-a7a1-5a71a206e686","resolution":{"observed_at":"2026-08-07T15:04:02.533337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:02.216913Z","title":"Compression-resistant backdoor attack against deep neural networks","venue":null,"work_id":"9020fc73-6d05-4aaf-9260-56591d468da4","year":2023},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:01.030790Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:b721348902608eb607f3666d8806824be2ee80004fa59f8462d7f47b8e674d29","observation_id":"0772a19f-d6a7-4ed8-9e35-e47d5d8c28e8","resolution":{"observed_at":"2026-08-07T15:04:02.340481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18275","last_updated":"2026-04-21T10:31:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-27T12:09:43Z","title":"Visual Adversarial Attack on Vision-Language Models for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18275","snapshot_observed_at":"2026-08-07T15:04:01.105850Z","title":"Visual adversarial attack on vision-language models for autonomous driving, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:01.105850Z"},"links":{"cited_paper":"/paper/2411.18275","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:941cf4276e4dd95ff715164b1d1d55b7a58ee24dfee11fbdf57f9a61f348d342","observation_id":"247a933f-e852-4bce-9e46-a762242dacaf","resolution":{"observed_at":"2026-08-07T15:04:01.105850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:02.019810Z","title":"Gadei: On scale-up training as a service for deep learning","venue":null,"work_id":"919c5f91-eb4f-478a-832f-e8c3e07ac5bf","year":2017},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:01.184490Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:17c10173a56c2b92a56797599e773e36462c4e48da7820a110cac58b5179a4a9","observation_id":"9fbc2bca-cdcd-453c-87f9-3ff02b1be280","resolution":{"observed_at":"2026-08-07T15:04:02.122146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:04:01.824187Z","title":"Badcm: Invisible backdoor attack against cross-modal learning","venue":null,"work_id":"47e3077a-4855-4f61-b84c-1d2da9f3246d","year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:01.262629Z"},"links":{"citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:dc4afc5a1a137133fe2a633537b602286441b56d07af5e2b3570f038dd8272bd","observation_id":"672997b2-8d01-46af-b5d2-e2b5ead04af4","resolution":{"observed_at":"2026-08-07T15:04:01.886203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19287","last_updated":"2024-11-12T10:48:21Z","snapshot_observed_at":"2026-07-06T18:07:27.432252Z","submitted_at":"2024-04-30T06:34:21Z","title":"Revisiting the Adversarial Robustness of Vision Language Models: a Multimodal Perspective","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19287","snapshot_observed_at":"2026-08-07T15:04:01.363663Z","title":"Pick up the alphabet soup and place it in the basket","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:01.363663Z"},"links":{"cited_paper":"/paper/2404.19287","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:921dc6cc7ca34a76b88f3d45baed2e5d6c92136e4e647064bbc98990907b0429","observation_id":"b9b58612-b4bb-4b69-a49d-d0ceda8543f4","resolution":{"observed_at":"2026-08-07T15:04:01.363663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.11099","last_updated":"2020-07-06T03:06:26Z","snapshot_observed_at":"2026-08-04T09:39:09.145603Z","submitted_at":"2019-10-18T02:20:17Z","title":"Adversarial T-shirt! Evading Person Detectors in A Physical World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.11099","snapshot_observed_at":"2026-08-07T15:04:00.985364Z","title":null,"venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:00.985364Z"},"links":{"cited_paper":"/paper/1910.11099","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:3165fb0d6951b110e56a4156ec02e0b16d91fd974f2d86cae99b8c2dcfa2d689","observation_id":"ce99ff9e-fb9f-4503-8784-e1aa91e03ff7","resolution":{"observed_at":"2026-08-07T15:04:00.985364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-07T14:55:29.164249Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":0,"verified_fuzzy":17},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 16 inbound Pith citation observations for arXiv:2505.16640."}