{"as_of":"2026-08-07T23:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:987ed92b8e149997305ab799dff3b8f6459e0b193838014d0775d56adef63859","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:45:56.219843Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:08:17.981943Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T19:48:57.413143Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07214","snapshot_observed_at":"2026-08-05T21:08:17.981943Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.09456","last_updated":"2026-03-22T02:44:18Z","snapshot_observed_at":"2026-08-05T21:08:15.205232Z","submitted_at":"2025-08-13T03:22:19Z","title":"IAG: Input-aware Backdoor Attack on VLM-based Visual Grounding","version":5},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T21:08:17.981943Z"},"links":{"cited_paper":"/paper/2506.07214","citing_paper":"/paper/2508.09456"},"observation_digest":"sha256:cf29f01f087a08ddaf3b1fe9818fde680c697bbea99483a501f3251d7c55222f","observation_id":"56f2af8f-f67a-4299-863e-101503cb78bf","resolution":{"observed_at":"2026-08-05T21:08:17.981943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"cited_work":{"arxiv_id":"2506.07214","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07214","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.07214 (2025)","venue":null,"work_id":"82f11707-32b6-47b2-9e65-10ecd6c8e7a4","year":2025},"citing_paper":{"arxiv_id":"2512.22046","last_updated":"2026-04-30T10:55:14Z","snapshot_observed_at":"2026-07-06T22:40:07.339525Z","submitted_at":"2025-12-26T14:48:58Z","title":"Backdoor Attacks on Prompt-Driven Video Segmentation Foundation Models","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-16T19:08:37.460895Z"},"links":{"cited_paper":"/paper/2506.07214","citing_paper":"/paper/2512.22046"},"observation_digest":"sha256:960b227906640a9fe67cf058f09d00e9270f5818d1a69903b53ac398a9fa68f2","observation_id":"0be98d1d-5f34-49b5-97ff-6f8f5ccb0bb7","resolution":{"observed_at":"2026-05-16T19:11:11.718943Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07214","snapshot_observed_at":"2026-07-15T12:42:28.672749Z","title":"arXiv preprint arXiv:2506.07214 (2025) 2","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.08316","last_updated":"2026-07-01T07:09:02Z","snapshot_observed_at":"2026-08-04T04:57:22.852231Z","submitted_at":"2026-03-09T12:38:28Z","title":"SlowBA: An efficiency backdoor attack towards VLM-based GUI agents","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-07-15T12:42:28.672749Z"},"links":{"cited_paper":"/paper/2506.07214","citing_paper":"/paper/2603.08316"},"observation_digest":"sha256:b1075981d407fffac84ded25a9d391032073b5860b8937c5f6c339b82a8bf241","observation_id":"49772814-d447-4fed-a4a4-27e2ce8f46ab","resolution":{"observed_at":"2026-07-15T12:42:28.672749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"cited_work":{"arxiv_id":"2506.07214","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07214","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.07214 (2025)","venue":null,"work_id":"82f11707-32b6-47b2-9e65-10ecd6c8e7a4","year":2025},"citing_paper":{"arxiv_id":"2604.08395","last_updated":"2026-04-09T15:55:33Z","snapshot_observed_at":"2026-07-06T22:57:31.046146Z","submitted_at":"2026-04-09T15:55:33Z","title":"Phantasia: Context-Adaptive Backdoors in Vision Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T17:46:01.742050Z"},"links":{"cited_paper":"/paper/2506.07214","citing_paper":"/paper/2604.08395"},"observation_digest":"sha256:4615b6861f267fea8feb7bcdb08133bc6a850633a3f22bc1a52d6a58dc8eb4db","observation_id":"30b0c0de-db8f-47a1-ae51-c1c7b5cdaca8","resolution":{"observed_at":"2026-05-11T06:11:01.191590Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"cited_work":{"arxiv_id":"2506.07214","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07214","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.07214 (2025)","venue":null,"work_id":"82f11707-32b6-47b2-9e65-10ecd6c8e7a4","year":2025},"citing_paper":{"arxiv_id":"2604.19083","last_updated":"2026-04-21T04:52:38Z","snapshot_observed_at":"2026-07-06T23:05:48.885141Z","submitted_at":"2026-04-21T04:52:38Z","title":"ProjLens: Unveiling the Role of Projectors in Multimodal Model Safety","version":1},"reference_index":195,"source":"arxiv_source","source_observed_at":"2026-05-10T03:00:34.862711Z"},"links":{"cited_paper":"/paper/2506.07214","citing_paper":"/paper/2604.19083"},"observation_digest":"sha256:3540691cdf858b75f6a1b75dfd28f19aae595505e8797ed641b5c79a004559f2","observation_id":"e024a2da-535e-4c3d-be5b-9a9eaf423334","resolution":{"observed_at":"2026-05-11T12:46:06.925920Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"cited_work":{"arxiv_id":"2506.07214","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07214","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.07214 (2025)","venue":null,"work_id":"82f11707-32b6-47b2-9e65-10ecd6c8e7a4","year":2025},"citing_paper":{"arxiv_id":"2605.15711","last_updated":"2026-05-15T08:01:32Z","snapshot_observed_at":"2026-07-06T23:26:56.013191Z","submitted_at":"2026-05-15T08:01:32Z","title":"EntropyScan: Towards Model-level Backdoor Detection in LVLMs via Visual Attention Entropy","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-20T19:46:49.000647Z"},"links":{"cited_paper":"/paper/2506.07214","citing_paper":"/paper/2605.15711"},"observation_digest":"sha256:a5dfea7d038afb6568898c744e562ba13552fe0b7efe2715fb9e132146a417f3","observation_id":"18780b23-03e8-4a2b-85e3-e035ab665efb","resolution":{"observed_at":"2026-05-20T19:48:57.414580Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07214/citation-record","integrity":"/paper/2506.07214/integrity","json":"/paper/2506.07214/citation-record.json","paper":"/paper/2506.07214"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.991555Z","title":"Improved baselines with visual instruction tuning,","venue":null,"work_id":"70b9c79a-6c9e-4020-8596-b0436c44e34e","year":null},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.022865Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:90feffe267a1af36477ede4b2b2d666be5d45fde5d3949a40d51b3469499b349","observation_id":"a6cb0417-934a-49e7-9edb-68ef3a555817","resolution":{"observed_at":"2026-08-07T05:45:56.994511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T05:45:56.029138Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.029138Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:ceb4d56a0836ffbc6ab317f30fdfd683527c55a31a1e89f4bee72de00efa885c","observation_id":"00fea122-afc2-4e0e-9a79-f0e56c3796f5","resolution":{"observed_at":"2026-08-07T05:45:56.029138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.984219Z","title":"Llama 3.2: Revolutionizing edge ai and vision with open, customizable models,","venue":null,"work_id":"99b04892-4f50-403f-b960-2594e1f0e202","year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.032101Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:2f2c1dafb30464f2c8496826bfdfdc7213b9bf861a78f41393e8aae42a7882f5","observation_id":"768710b3-4128-4208-b581-6633d4db11d3","resolution":{"observed_at":"2026-08-07T05:45:56.987092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.976974Z","title":"Backdooring vision- language models with out-of-distribution data,","venue":null,"work_id":"450471dc-c618-4b40-a14a-2496d7a148fe","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.034982Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:9065d7ef33cb3499793c1266d0a8651635c127dea4c1f0420db8eb764dbfacf3","observation_id":"c135fcf9-1a90-4ee8-bcb1-c9cb72b4bf49","resolution":{"observed_at":"2026-08-07T05:45:56.979739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18290","last_updated":"2025-03-26T06:37:46Z","snapshot_observed_at":"2026-08-07T17:49:50.490755Z","submitted_at":"2025-02-25T15:28:41Z","title":"Stealthy Backdoor Attack in Self-Supervised Learning Vision Encoders for Large Vision Language Models","version":3},"cited_work":{"arxiv_id":"2502.18290","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.18290","snapshot_observed_at":"2026-08-07T05:45:56.651959Z","title":"Stealthy Backdoor Attack in Self-Supervised Learning Vision Encoders for Large Vision Language Models","venue":"cs.CV","work_id":"ee45c09e-3234-4493-90c2-6e7c414e92b0","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.037668Z"},"links":{"cited_paper":"/paper/2502.18290","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:018aaca35d60070b3a56cacc69616ab3e1e68963ebc6f9ca9f6ae6c5c04b056e","observation_id":"af656723-1504-4f8b-9222-ac6fceacebcb","resolution":{"observed_at":"2026-08-07T05:45:56.655101Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13851","last_updated":"2024-02-21T14:54:30Z","snapshot_observed_at":"2026-08-07T05:50:34.189767Z","submitted_at":"2024-02-21T14:54:30Z","title":"VL-Trojan: Multimodal Instruction Backdoor Attacks against Autoregressive Visual Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13851","snapshot_observed_at":"2026-08-07T05:45:56.040880Z","title":"Vl-trojan: Multimodal instruction backdoor attacks against autoregressive visual language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.040880Z"},"links":{"cited_paper":"/paper/2402.13851","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:cfb159b869d29ef64a5aea7d3df4e39c89011b9ed23b2a14fb04b5760260b4e3","observation_id":"8fd0ed94-953b-4294-a669-865a17b2ce9f","resolution":{"observed_at":"2026-08-07T05:45:56.040880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-73650-6_27","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.254884Z","title":"Trojvlm: Backdoor attack against vision language models,","venue":null,"work_id":"e9c925bc-b9d3-4f38-b456-10d8215ed5fa","year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.044033Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:b887b031dbdebc857916e7f59f6c7771653cd9d0796b155d38dd240e87be29de","observation_id":"eb648ba0-35e6-4a79-8026-7e7598b424d0","resolution":{"observed_at":"2026-08-07T05:45:56.259423Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.969370Z","title":"Shadowcast: Stealthy data poisoning attacks against vision-language models,","venue":null,"work_id":"7252e87a-dd2a-48c8-b764-3a0d0f25f65e","year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.046642Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:c685a11cb7341b60c0d914293b44ab4125ddb7ee72490a4eaa6c4d6d50d2b141","observation_id":"bfba5768-c051-45f0-a4b0-bfa87b5bae02","resolution":{"observed_at":"2026-08-07T05:45:56.972248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.06733","last_updated":"2019-03-11T20:45:33Z","snapshot_observed_at":"2026-07-06T05:56:16.413472Z","submitted_at":"2017-08-22T17:31:54Z","title":"BadNets: Identifying Vulnerabilities in the Machine Learning Model Supply Chain","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.06733","snapshot_observed_at":"2026-08-07T05:45:56.049170Z","title":"Badnets: Identifying vulnerabilities in the machine learning model supply chain,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.049170Z"},"links":{"cited_paper":"/paper/1708.06733","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:d9b5ae4c7a808e81767cc06e434cd3a0c32b329c80f41642473a1ddd87e58757","observation_id":"ef2d59d7-44e9-4e02-bdb9-f06868991415","resolution":{"observed_at":"2026-08-07T05:45:56.049170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.961751Z","title":"Poisoning and backdooring contrastive learning,","venue":null,"work_id":"ee4fcf04-9af8-44ca-bbf0-f10e630a53a1","year":2022},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.052147Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:d2c282eefb919268cab1bfc3be73ea41f5fd3c2c07f7e5b667c90d2da1d51e4e","observation_id":"a6488e06-11e7-4e7d-b750-d4d667b015a3","resolution":{"observed_at":"2026-08-07T05:45:56.964662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05213","last_updated":"2024-07-06T23:56:43Z","snapshot_observed_at":"2026-07-06T18:42:26.589950Z","submitted_at":"2024-07-06T23:56:43Z","title":"BadCLM: Backdoor Attack in Clinical Language Models for Electronic Health Records","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05213","snapshot_observed_at":"2026-08-07T05:45:56.060053Z","title":"Badclm: Backdoor attack in clinical language models for electronic health records,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.060053Z"},"links":{"cited_paper":"/paper/2407.05213","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:40646251b84ebbf2c94446330b8d76703c8f74b280f2182d0714891bcc62ab43","observation_id":"eb291362-1dba-4324-939a-6c4eed9132c6","resolution":{"observed_at":"2026-08-07T05:45:56.060053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.063013Z","title":"Badnl: Backdoor attacks against NLP models with semantic-preserving improvements,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.063013Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:2e8e05ca802c7d8a9eb1827fde5267731b7050666e8e2a9edb2bb1a0798a1cf2","observation_id":"3d643b54-d96b-4bbc-bf5b-e81d64d4e729","resolution":{"observed_at":"2026-08-07T05:45:56.063013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.945726Z","title":"Drivellava: Human-level behavior decisions via vision language model,","venue":null,"work_id":"e5411128-ec42-4fe7-a013-3cdeebd997f9","year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.065646Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:bae632504077441837c69d7f70dfb059ad0822e27cdf093f0da87a58a9241a11","observation_id":"3e18bc35-b50e-4445-982c-5551ffaeb0db","resolution":{"observed_at":"2026-08-07T05:45:56.948630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09251","last_updated":"2025-06-19T05:02:13Z","snapshot_observed_at":"2026-07-06T19:01:58.598116Z","submitted_at":"2024-08-17T16:42:13Z","title":"V2X-VLM: End-to-End V2X Cooperative Autonomous Driving Through Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09251","snapshot_observed_at":"2026-08-07T05:45:56.068192Z","title":"V2x-vlm: End-to-end v2x cooperative autonomous driving through large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.068192Z"},"links":{"cited_paper":"/paper/2408.09251","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:7e68fbde3715564b1728f1e2b56854cd134a0c3f04bed76d30959624d970673a","observation_id":"a0f0db94-d0fc-474f-98a3-f1917d5320ad","resolution":{"observed_at":"2026-08-07T05:45:56.068192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03378","last_updated":"2023-03-06T18:58:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-06T18:58:06Z","title":"PaLM-E: An Embodied Multimodal Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03378","snapshot_observed_at":"2026-08-07T05:45:56.070868Z","title":"Palm-e: An embodied multimodal language model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.070868Z"},"links":{"cited_paper":"/paper/2303.03378","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:2fa4cf57ee146109ee46cfe8613aae1905476a43ca38daf7c11b208eeadc4fb6","observation_id":"5f35430a-88b7-4d7a-a17f-a730aea5a817","resolution":{"observed_at":"2026-08-07T05:45:56.070868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10721","last_updated":"2024-06-15T19:22:51Z","snapshot_observed_at":"2026-07-06T18:31:36.504766Z","submitted_at":"2024-06-15T19:22:51Z","title":"RoboPoint: A Vision-Language Model for Spatial Affordance Prediction for Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10721","snapshot_observed_at":"2026-08-07T05:45:56.073790Z","title":"Robopoint: A vision-language model for spatial affordance prediction 14 for robotics,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.073790Z"},"links":{"cited_paper":"/paper/2406.10721","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:64b539032434c9dbf83b604ddf2deebe59560ada95890838eb7cd97e5d669616","observation_id":"27e4b751-6c31-4737-b6b3-7cb5d2275871","resolution":{"observed_at":"2026-08-07T05:45:56.073790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08577","last_updated":"2024-02-13T16:28:28Z","snapshot_observed_at":"2026-08-03T16:35:46.376448Z","submitted_at":"2024-02-13T16:28:28Z","title":"Test-Time Backdoor Attacks on Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08577","snapshot_observed_at":"2026-08-07T05:45:56.076595Z","title":"Test-time backdoor attacks on multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.076595Z"},"links":{"cited_paper":"/paper/2402.08577","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:758211ecd60b3b6b4830a070132c5109f14260ca214605d004fc2586b2f1dbdd","observation_id":"88009e1d-8e5f-48af-b396-c6847873649b","resolution":{"observed_at":"2026-08-07T05:45:56.076595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.938124Z","title":"Bait: Large language model backdoor scanning by in- verting attack target,","venue":null,"work_id":"c2291a90-36f2-4f90-bc19-68a0b5461f57","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.079389Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:f9775b34ff26ebfd31d6a5569c9c9dde7527ab6add186a8c0e4b3a4bc6aa7951","observation_id":"c9da351e-23e0-4da1-a9b5-d11b06f33829","resolution":{"observed_at":"2026-08-07T05:45:56.941077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.930522Z","title":"Better trigger inversion optimization in backdoor scanning,","venue":null,"work_id":"e848bf02-ed6d-4762-9a18-4ad4a5f4eeba","year":2022},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.081952Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:f31eb95330cff79edcf9cee7f4b62ef828c00e3cb73f1ad4d72ce18316f9c81d","observation_id":"3dc9d800-54f9-47bd-a093-d40566650eed","resolution":{"observed_at":"2026-08-07T05:45:56.933458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15266","last_updated":"2023-06-05T13:52:24Z","snapshot_observed_at":"2026-08-02T08:51:18.666212Z","submitted_at":"2022-09-30T06:50:08Z","title":"Data Poisoning Attacks Against Multimodal Encoders","version":2},"cited_work":{"arxiv_id":"2209.15266","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.15266","snapshot_observed_at":"2026-08-07T05:45:56.596310Z","title":"Data Poisoning Attacks Against Multimodal Encoders","venue":"cs.CR","work_id":"d1f950dd-884d-4608-ad18-8caed991a167","year":2022},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.084461Z"},"links":{"cited_paper":"/paper/2209.15266","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:93cff98b8209e1eb9096b5df245dc36ff3c82edc3789a97bc3346a64c8cad1d3","observation_id":"b6db61e9-aecf-44eb-839d-4d61e53f7d91","resolution":{"observed_at":"2026-08-07T05:45:56.599339Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.923192Z","title":"Gpt-4o system card,","venue":null,"work_id":"72f6db08-1816-404d-a095-72fb687c382e","year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.087214Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:d58ab007ecd71fff85961fec52ea081fabceaafb17060ec5d5e82f59aba18b6f","observation_id":"d0d1aff9-c36c-462a-9661-4c09858d7750","resolution":{"observed_at":"2026-08-07T05:45:56.925838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.916155Z","title":"Gemini 2.0 flash,","venue":null,"work_id":"9ebb4fe7-2152-4498-9548-6d1c2d737b45","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.089794Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:6df74cede08c441dd60948bc575455d2532836a78155b78e681f83a57dc31d1b","observation_id":"ee415a58-d2af-4620-b7d0-e4b29722c1d3","resolution":{"observed_at":"2026-08-07T05:45:56.918434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00253","last_updated":"2024-05-06T01:10:01Z","snapshot_observed_at":"2026-07-06T17:23:26.913214Z","submitted_at":"2024-02-01T00:33:21Z","title":"A Survey on Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00253","snapshot_observed_at":"2026-08-07T05:45:56.092242Z","title":"A survey on hallucination in large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.092242Z"},"links":{"cited_paper":"/paper/2402.00253","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:174f5775d77a0cfbc81d647eaaec60504e5ce8e232de772b252e29f2c2033617","observation_id":"261ec98c-7004-4ffe-bc27-02b7cd0d7b1c","resolution":{"observed_at":"2026-08-07T05:45:56.092242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.095405Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.095405Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:739d1f8eed57a574619042b4a4a7159ee4b643456eae407d2293da28a583a804","observation_id":"2193722c-be14-4d1a-9fef-be69133f5dc4","resolution":{"observed_at":"2026-08-07T05:45:56.095405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.898613Z","title":"Lora: Low-rank adaptation of large language models,","venue":null,"work_id":"8eed787c-ab11-41f6-af63-8093200ca5d1","year":null},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.101149Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:db1df67d7e072543c86743f28f4d30606de7f55fae905a3a8cf974741e2a43ab","observation_id":"a5183cfe-608e-42de-8254-5f050d81ab85","resolution":{"observed_at":"2026-08-07T05:45:56.901321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.884880Z","title":"Backdoor attacks against learning systems,","venue":null,"work_id":"12ad41e3-d24c-4c62-a90f-ddf2d8002232","year":2017},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.107055Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:8b3a9d522f01a4dd6e62fa8cd84bd15b27e82aaaf52ce4cecf4cc72915f48163","observation_id":"0d14e824-d763-4565-a791-8b94747063ef","resolution":{"observed_at":"2026-08-07T05:45:56.887433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05526","last_updated":"2017-12-15T04:26:26Z","snapshot_observed_at":"2026-07-06T06:14:30.795326Z","submitted_at":"2017-12-15T04:26:26Z","title":"Targeted Backdoor Attacks on Deep Learning Systems Using Data Poisoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05526","snapshot_observed_at":"2026-08-07T05:45:56.109452Z","title":"Targeted backdoor attacks on deep learning systems using data poisoning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.109452Z"},"links":{"cited_paper":"/paper/1712.05526","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:1f9ea9edc0c21474b971412eb18182af24f315dc89ba54cf1a358921f474b3b2","observation_id":"924b8ed7-7c1b-49b5-ad1f-1ea604261169","resolution":{"observed_at":"2026-08-07T05:45:56.109452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.877950Z","title":"Weight poisoning attacks on pretrained models,","venue":null,"work_id":"0a2261a5-e80b-42e3-b75a-5d2f3429e5b3","year":2020},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.111848Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:9555c37c95b2ba332ed8b9eccc98804ad2a97a8401185169256cace7fd1501c5","observation_id":"e5251851-bc3b-4569-b3c5-b0aa2a82d093","resolution":{"observed_at":"2026-08-07T05:45:56.880660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.891510Z","title":"Available: https://openreview.net/for um?id=nZeVKeeFYf9 3, 6","venue":null,"work_id":"bd7feca6-b332-478e-8071-0c48267d3e0c","year":null},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.103991Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:7e56a6a295d0f7d9cb3a4ab904de4c5f8bed8f7c7603a758604f5f93eb47a120","observation_id":"b32a1222-9944-40e0-aff8-49a7c8513fef","resolution":{"observed_at":"2026-08-07T05:45:56.894243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.864316Z","title":"Hidden killer: Invisible textual backdoor attacks with syntactic trigger,","venue":null,"work_id":"d623bb50-6fed-4157-ba47-bf8ab0a13b93","year":2021},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.116810Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:f2828182ff55d25878ef656c54c914f440f759c30458c3ab74a33351dd4c458d","observation_id":"09f7747f-8732-44cc-bb44-a9a81a3398a0","resolution":{"observed_at":"2026-08-07T05:45:56.866989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.857255Z","title":"Mind the style of text! adversarial and backdoor attacks based on text style transfer,","venue":null,"work_id":"054535ac-eecd-4645-8ab4-7912c168ac14","year":2021},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.119339Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:7ff205802917122326a8899f2e09914c08511983bb6beaad95dd703c1f9fd863","observation_id":"b84b352a-0573-42d3-b453-a71ace2f3fd8","resolution":{"observed_at":"2026-08-07T05:45:56.860011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00197","last_updated":"2021-10-30T07:11:24Z","snapshot_observed_at":"2026-07-06T12:03:42.294180Z","submitted_at":"2021-10-30T07:11:24Z","title":"Backdoor Pre-trained Models Can Transfer to All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00197","snapshot_observed_at":"2026-08-07T05:45:56.121769Z","title":"Backdoor pre- trained models can transfer to all,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.121769Z"},"links":{"cited_paper":"/paper/2111.00197","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:6736f13ebedd6a68ee17605d74b108e5603bd80ae47468dadd2dce45a87b0cad","observation_id":"7c5cf015-a36d-455c-8fc0-e8d1f7a3b9f4","resolution":{"observed_at":"2026-08-07T05:45:56.121769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.871089Z","title":"A backdoor attack against lstm-based text classification systems,","venue":null,"work_id":"f7724178-d16c-4be2-9c91-a82807257a2e","year":2019},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.114216Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:0045f74c64f653e28e64c99480a8bc04403fad688f63240c00c1f98504443b3b","observation_id":"69c7ab8d-e99f-480c-9944-ce0a40d274d2","resolution":{"observed_at":"2026-08-07T05:45:56.873765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.850093Z","title":"Lora-as-an-attack! piercing llm safety under the share-and-play scenario,","venue":null,"work_id":"5ce063a2-e165-4bb6-ab75-541544f6df6e","year":null},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.127088Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:5368cf58a782c7796c2b8744af36ce7df6a3eaa4f9cdafb77e1126d0315b4647","observation_id":"d4a748be-ca8e-48f7-8d6d-cf51eadc7051","resolution":{"observed_at":"2026-08-07T05:45:56.852904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05566","last_updated":"2024-01-17T20:26:01Z","snapshot_observed_at":"2026-07-06T17:14:03.152949Z","submitted_at":"2024-01-10T22:14:35Z","title":"Sleeper Agents: Training Deceptive LLMs that Persist Through Safety Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05566","snapshot_observed_at":"2026-08-07T05:45:56.129528Z","title":"Sleeper agents: Train- ing deceptive llms that persist through safety training,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.129528Z"},"links":{"cited_paper":"/paper/2401.05566","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:68bc3f2e455567a42b921fbd916f6c5514add6c9cff6ee7e047bdd05f482d4ba","observation_id":"0f5e6972-07ca-4094-8308-210a46c88f07","resolution":{"observed_at":"2026-08-07T05:45:56.129528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.843322Z","title":"Poisoning language models during instruction tuning,","venue":null,"work_id":"5052dd01-c1ee-4bb1-a0a7-3b631ab0071d","year":2023},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.132214Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:e2ebbee3a44a6f235c202ba570cdc2e89eaccf1b8d7cdf83f1ce219021b64a6a","observation_id":"cd834970-b9e7-4d3f-ac92-8414aee44c0a","resolution":{"observed_at":"2026-08-07T05:45:56.846036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.124631Z","title":"Backdoor pre- trained models can transfer to all,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.124631Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:bf0e958d6270e0090b53ddc7433925451642bdeaf235a8d25bf757e25673c78b","observation_id":"0297524c-9f8f-4e5b-a3f1-3692d71570c5","resolution":{"observed_at":"2026-08-07T05:45:56.124631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.836097Z","title":"Backdooring instruction-tuned large language models with virtual prompt injection,","venue":null,"work_id":"5ebaa964-f1c5-43d8-b043-27f973d0e896","year":2023},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.137596Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:72cd4c5a2797814bacdcabecc02480204d5b673209670bfca36bfacdca7efac7","observation_id":"13554ec4-ca22-4ef9-9013-a1475065331a","resolution":{"observed_at":"2026-08-07T05:45:56.838874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.829356Z","title":"Backdooring multimodal learn- 15 ing,","venue":null,"work_id":"c452ee1a-f712-494e-ad81-c4c6b9a663df","year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.140371Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:c7b5f9d08bf554226841ee207286edef9c80df8fc0446bdc114cbd138302ed30","observation_id":"325a6572-ecd8-4fb6-853a-a83805baa43a","resolution":{"observed_at":"2026-08-07T05:45:56.831910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.821311Z","title":"azure-open-dataset,","venue":null,"work_id":"f9191553-f5da-4d10-b2e5-a70d5cb2f294","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.142947Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:a1701041db045ab09fb1459c4521fca7d968d7dffe9d944d98ef74d615936917","observation_id":"46153329-7c30-45db-a824-f0dbb9571036","resolution":{"observed_at":"2026-08-07T05:45:56.824901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14710","last_updated":"2024-04-03T09:15:15Z","snapshot_observed_at":"2026-08-06T20:08:37.704569Z","submitted_at":"2023-05-24T04:27:21Z","title":"Instructions as Backdoors: Backdoor Vulnerabilities of Instruction Tuning for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14710","snapshot_observed_at":"2026-08-07T05:45:56.134629Z","title":"Instructions as backdoors: Backdoor vulnerabilities of instruction tuning for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.134629Z"},"links":{"cited_paper":"/paper/2305.14710","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:fe8259e996b7533c7c7fc8fbd4d238233c59e59ed528d3b96b4c0643987e1e04","observation_id":"d5f5a94d-64c7-4426-be51-ccce25be8610","resolution":{"observed_at":"2026-08-07T05:45:56.134629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.807265Z","title":"Visual hallucinations of multi-modal large language models,","venue":null,"work_id":"db010c75-38cd-4c80-9756-ff13f0f2785c","year":null},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.147967Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:c7ee3d35892888171dbab3bdc5d9377eaebc7c67f1dc4fa3886daa666457ea2e","observation_id":"20b77c5b-e19f-439c-8517-ec2b6efb34f2","resolution":{"observed_at":"2026-08-07T05:45:56.809992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06209","last_updated":"2024-04-25T07:12:39Z","snapshot_observed_at":"2026-07-06T17:14:32.455890Z","submitted_at":"2024-01-11T18:58:36Z","title":"Eyes Wide Shut? Exploring the Visual Shortcomings of Multimodal LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06209","snapshot_observed_at":"2026-08-07T05:45:56.153036Z","title":"Eyes wide shut? exploring the visual shortcomings of multimodal llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.153036Z"},"links":{"cited_paper":"/paper/2401.06209","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:102d3a1b6b8fbe46f86fd55e9d0711031f1fe4a23997e1921db47ac62c9ae023","observation_id":"03aea609-f8a5-465a-bd29-24afa8a79559","resolution":{"observed_at":"2026-08-07T05:45:56.153036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.155786Z","title":"Colorbench: Can vlms see and understand the colorful world? a comprehensive benchmark for color perception, reasoning, and robustness,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.155786Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:f5cd05b9cc32adf0a445315bec2be44e7103cb26075f6f1e8d947bda0514739f","observation_id":"b754bf65-e1b6-4b1e-a781-8b9beb442551","resolution":{"observed_at":"2026-08-07T05:45:56.155786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.814166Z","title":"huggingface-dataset,","venue":null,"work_id":"7ce9d21d-1a72-4130-a8ad-83183b62a151","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.145469Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:277b8e1bfcf763d3fa95fb39a30b97cb3c3e83fe6b3f92739d6d788d1fd5b42f","observation_id":"9a61990d-2610-4f94-935b-08a4f8fca34c","resolution":{"observed_at":"2026-08-07T05:45:56.816881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17761","last_updated":"2025-07-31T05:05:45Z","snapshot_observed_at":"2026-07-06T21:14:24.007428Z","submitted_at":"2025-04-24T17:25:12Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17761","snapshot_observed_at":"2026-08-07T05:45:56.160952Z","title":"Step1x-edit: A practical framework for general image editing,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.160952Z"},"links":{"cited_paper":"/paper/2504.17761","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:f52d49628fece7a32f2a85e83769e9591a8c1c033ec67ff1ac5c1e6b9a6f0dc4","observation_id":"bf163804-42f1-4339-8915-b2b139b78604","resolution":{"observed_at":"2026-08-07T05:45:56.160952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.799845Z","title":"Available: https://arxiv.org/abs/2402.1 4683 4, 13","venue":null,"work_id":"b6391317-02cb-41d6-b51f-d47a0c88b368","year":null},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.150450Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:ef6d33eadee9d22954eccdcd5d9871e083389ebf27665897f82e3959ee475971","observation_id":"8e01036b-05ac-4410-b93c-a4cfbc1c5476","resolution":{"observed_at":"2026-08-07T05:45:56.802594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.792001Z","title":"Qwen2.5-vl,","venue":null,"work_id":"e5a268d3-ec3c-420a-ac07-de1630e8b994","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.165859Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:d7d89cc2a4d09c6380722081537eb9dc8ac41e048713b51b5b4b811137206084","observation_id":"be3cd4ab-8ce9-46b9-b600-89047d23bb88","resolution":{"observed_at":"2026-08-07T05:45:56.794979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.784278Z","title":"Gemma 3-4b,","venue":null,"work_id":"f7ce27bd-d4c3-494f-92f6-9424a7f7254f","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.168156Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:accd0c142a285417cd02db776e31f5e3b0174bc4b7eec29eea685f9abafae9e1","observation_id":"181f3c84-8a10-4082-9b19-990952a521f5","resolution":{"observed_at":"2026-08-07T05:45:56.787078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-07T05:45:56.158352Z","title":"Grounded sam: Assembling open-world models for diverse visual tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.158352Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:53f63ada290001679500e9291c0efd09b4df35c580ff3e3325636a6a844d247d","observation_id":"26d672a1-9399-4cfa-9b28-80baccf2219e","resolution":{"observed_at":"2026-08-07T05:45:56.158352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T05:45:56.172886Z","title":"Qwen2.5-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.172886Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:3f9cc12f6e44e69bb62db17e0bf50aa5a96d0553e39e1c2e9d3a7edc8193f682","observation_id":"21182d8c-f859-45bc-bd89-190ac3c97ca5","resolution":{"observed_at":"2026-08-07T05:45:56.172886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.163474Z","title":"Diffusion model-based image editing: A survey,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.163474Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:e76848186e432e84c46dc768ac74d429688f9ee8987559ce7dccd064df859ff7","observation_id":"11dbd6c3-9897-4ac3-9064-ecfc134b72b9","resolution":{"observed_at":"2026-08-07T05:45:56.163474Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.00170","last_updated":"2018-06-30T12:49:55Z","snapshot_observed_at":"2026-07-06T06:47:42.995007Z","submitted_at":"2018-06-30T12:49:55Z","title":"Self-consistency of voting implies majority vote","version":1},"cited_work":{"arxiv_id":"1807.00170","doi":null,"metadata_source":"pith","pith_arxiv_id":"1807.00170","snapshot_observed_at":"2026-08-07T05:45:56.378036Z","title":"Self-consistency of voting implies majority vote","venue":"cs.GT","work_id":"2f038b3c-2430-4329-8261-9374b98d5cfd","year":2018},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.178655Z"},"links":{"cited_paper":"/paper/1807.00170","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:c6650831f7d68f8143cf10a49a7ad0992690f2ebf74845c687f082d61879c3ed","observation_id":"0efd13b3-7c03-46a5-9e15-e4a37eef5cc1","resolution":{"observed_at":"2026-08-07T05:45:56.381292Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.768279Z","title":"Llava-1.5,","venue":null,"work_id":"5e6e305f-dab5-42dd-9f3f-5843a11c9e52","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.181383Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:2a4c271f2ff39bd2888147ec58909b4eb646e64e584643d5d53bbcb7177dc2bb","observation_id":"4c71b8be-ab86-4859-8903-c3a706ba4fc1","resolution":{"observed_at":"2026-08-07T05:45:56.771304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.776336Z","title":"Gemma 3-12b,","venue":null,"work_id":"7f749820-50bd-4316-8b6d-9dfd31ab0440","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.170443Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:d987bc53461ba6f04e7bc035410ee2cbb74e25dce02c1175a011b3b7d455b8ac","observation_id":"760e5579-32c2-45be-9344-7e6bf20af0f3","resolution":{"observed_at":"2026-08-07T05:45:56.779274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.752414Z","title":"Llama 3.2-vision,","venue":null,"work_id":"d3a1faef-be71-4224-a8f9-5f954e2823bd","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.186091Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:57f508cfea195c5501d3fa4fbfc73ef8a7de12ee3090fd56d006ccaad5392168","observation_id":"b1bd4ee8-019a-4b49-8e72-bd7c243664dc","resolution":{"observed_at":"2026-08-07T05:45:56.755207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-07T05:45:56.175491Z","title":"Gemma 3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.175491Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:8fbb6dee10952c8f1ff9525bba7b3d8866ba949792e061470f77747c033ed888","observation_id":"20332416-ac87-42b8-bf00-9ee0bd41b8dd","resolution":{"observed_at":"2026-08-07T05:45:56.175491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.744490Z","title":"Gqa: A new dataset for real-world visual reasoning and composi- tional question answering,","venue":null,"work_id":"20d71e6e-6405-4455-891e-687d40bb850a","year":2019},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.191078Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:2f2983e5748e855a2eb7fb01344c36ef0495c11f3dde65a9a11d0c92d056ddd3","observation_id":"16f29a1b-9517-4780-a726-f36c3b9e4fa1","resolution":{"observed_at":"2026-08-07T05:45:56.747536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.736210Z","title":"Llamafactory: Unified efficient fine-tuning of 100+ language models,","venue":null,"work_id":"aa972a1d-8ec0-4780-be96-03860f6edf92","year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.193526Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:7f504ad31671fbc356425b4cac602631d8f91624d502c15b31da8c4fedf31caf","observation_id":"9e098aa4-c64d-4590-a0d8-c0eb3f1ef693","resolution":{"observed_at":"2026-08-07T05:45:56.739346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.760129Z","title":"Qwen2-vl,","venue":null,"work_id":"b35b11a3-2c0a-4e4d-a8e4-0b039c01fa61","year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.183804Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:9e73d526412fd1e6019f09aea8b6613962ab76edac8cc8133295329b0a0525d7","observation_id":"d9ffd8b3-11c2-4588-8528-258d3074c987","resolution":{"observed_at":"2026-08-07T05:45:56.763038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2021.01615","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.360464Z","title":"Invisible backdoor attack with sample-specific triggers,","venue":null,"work_id":"aa22f7af-c021-4bed-a2ff-97f7c64c5beb","year":2021},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.198752Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:0b14ff16a2e2a5d505e6f69bff397113ead767ca0eec973e64b2397cf8de65a2","observation_id":"5643c838-99ef-457e-a4c4-4af854cfbca7","resolution":{"observed_at":"2026-08-07T05:45:56.364627Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.188568Z","title":"Making the V in VQA matter: Elevating the role of image understanding in visual question answering,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.188568Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:7b17f75e127dfed7a037851650fa8f22b3ed6af67d71894aca1d67730db6376f","observation_id":"9910855a-c058-4f3d-9388-ca14f263d480","resolution":{"observed_at":"2026-08-07T05:45:56.188568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.727622Z","title":"Revisiting backdoor attacks against large vision-language models from domain shift,","venue":null,"work_id":"94f76eee-82e5-4e1d-bdf4-fe16263d72b5","year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.203835Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:8d97738846e92d3f2074bf03dc3756b6e90ecb415a0af5d25b63c03cff7a6297","observation_id":"fb38b32c-6f43-4021-b41f-0722234779f4","resolution":{"observed_at":"2026-08-07T05:45:56.730766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.206256Z","title":"Cl- attack: Textual backdoor attacks via cross-lingual triggers,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.206256Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:ba31a5ec969978f6fa6135dc6b6dc9f6ba3fb74849b0d046b023f13a72d98352","observation_id":"e4ba4c13-a3cd-4140-8685-2da4ca31a226","resolution":{"observed_at":"2026-08-07T05:45:56.206256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12798","last_updated":"2025-05-19T04:34:50Z","snapshot_observed_at":"2026-07-06T19:04:52.658000Z","submitted_at":"2024-08-23T02:21:21Z","title":"BackdoorLLM: A Comprehensive Benchmark for Backdoor Attacks and Defenses on Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12798","snapshot_observed_at":"2026-08-07T05:45:56.195950Z","title":"Backdoorllm: A comprehensive benchmark for backdoor attacks on large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.195950Z"},"links":{"cited_paper":"/paper/2408.12798","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:dc484d79872f460f616a34eb23a469aa121b5f48eb23342ea36325df3f22f3bf","observation_id":"e095e507-a3e2-4e29-8570-d1b6a2f9c7c0","resolution":{"observed_at":"2026-08-07T05:45:56.195950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19521","last_updated":"2025-08-21T07:12:54Z","snapshot_observed_at":"2026-08-07T15:58:42.621001Z","submitted_at":"2025-04-28T06:40:01Z","title":"Security Steerability is All You Need","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19521","snapshot_observed_at":"2026-08-07T05:45:56.211530Z","title":"Security steerability is all you need,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.211530Z"},"links":{"cited_paper":"/paper/2504.19521","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:d6213bfa60b9bd341af87e83d3501fe94217f419d3e7cb7d324b79a7db22ac83","observation_id":"8c35a0bb-f46f-4451-8176-3b1abee99629","resolution":{"observed_at":"2026-08-07T05:45:56.211530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.201249Z","title":"Mind the style of text! adversarial and backdoor attacks based on text style transfer,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.201249Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:275c9f0d7124a255c7414fd139b15a2796c3c4cc9479e8466b2930a68a990ef0","observation_id":"9071bc66-f75a-452b-b435-22fdc62157bc","resolution":{"observed_at":"2026-08-07T05:45:56.201249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03118","last_updated":"2024-06-24T22:45:20Z","snapshot_observed_at":"2026-07-06T17:55:24.972926Z","submitted_at":"2024-04-03T23:57:34Z","title":"LVLM-Interpret: An Interpretability Tool for Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03118","snapshot_observed_at":"2026-08-07T05:45:56.217075Z","title":"Lvlm-interpret: An interpretabil- ity tool for large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.217075Z"},"links":{"cited_paper":"/paper/2404.03118","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:b2afec488d3ba01db2c5266b27d816475bc7283e2bbc11ec3ccf71e1938c6527","observation_id":"374baade-a7fc-4e4a-8609-d378d609dd23","resolution":{"observed_at":"2026-08-07T05:45:56.217075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04034","last_updated":"2025-06-04T14:56:57Z","snapshot_observed_at":"2026-08-07T10:46:30.489099Z","submitted_at":"2025-06-04T14:56:57Z","title":"Rex-Thinker: Grounded Object Referring via Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04034","snapshot_observed_at":"2026-08-07T05:45:56.219843Z","title":"Rex-thinker: Grounded object referring via chain- of-thought reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.219843Z"},"links":{"cited_paper":"/paper/2506.04034","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:ba61e9ec914ad170836136f83af55889c1d596c28ff23259e5db8e22715b3b58","observation_id":"01b29d15-f705-4829-be0e-7b83ac537305","resolution":{"observed_at":"2026-08-07T05:45:56.219843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09067","last_updated":"2022-12-18T11:30:59Z","snapshot_observed_at":"2026-08-05T17:14:24.121423Z","submitted_at":"2022-12-18T11:30:59Z","title":"Fine-Tuning Is All You Need to Mitigate Backdoor Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09067","snapshot_observed_at":"2026-08-07T05:45:56.208799Z","title":"Fine-tuning is all you need to mitigate backdoor attacks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.208799Z"},"links":{"cited_paper":"/paper/2212.09067","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:b82164024524a566126e7bed5265e6b60d0f3179e1d00e892af87fbaffa26f50","observation_id":"60d9ec34-bc6f-4b60-8150-f58f7bffc2f5","resolution":{"observed_at":"2026-08-07T05:45:56.208799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-07-06T20:33:01.960703Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05224","snapshot_observed_at":"2026-08-07T05:45:56.214257Z","title":"A survey on backdoor threats in large language models (llms): Attacks, defenses, and evaluations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.214257Z"},"links":{"cited_paper":"/paper/2502.05224","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:3fa37132fbb6da1a2116a1c526e25e0462477475930054e00acf2a7a2f62b3ed","observation_id":"c83337f1-0912-470d-84b6-9313d3743c0e","resolution":{"observed_at":"2026-08-07T05:45:56.214257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.905447Z","title":"Available: https://arxiv.org/abs/2103.0 0020 2","venue":null,"work_id":"264b561d-f35e-48a7-b556-82f510a7d23f","year":null},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.098145Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:67659458a2127ef3d73ebbe9481f2fa9f6e567ae2e60f8488f56c61d0157b964","observation_id":"a0d7e316-d7bb-4af9-96c1-e5fdf505e56d","resolution":{"observed_at":"2026-08-07T05:45:56.908217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.953861Z","title":"Available: https://openreview.net/for um?id=iC4UHbQ01Mp 1, 2, 3","venue":null,"work_id":"701c11a8-d93c-4822-9861-6fcb08e0f074","year":null},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.054600Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:38cdf174e9e019b47cbd370af8d39e8285b7a354352d75d8d60ae7511aba3a10","observation_id":"0528850e-819c-44ce-b297-7f8443cfa466","resolution":{"observed_at":"2026-08-07T05:45:56.956968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:45:56.026292Z","title":"Available: https://doi.org/10.1109/CV PR52733.2024.02484 1, 2, 3, 6","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.026292Z"},"links":{"citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:65b1c9f1afe74418eadd0d33d3b1311a8944ef4d56c0a5e4a772005d292cabc6","observation_id":"33f4305a-204b-424a-9d7d-8d81101f5f0e","resolution":{"observed_at":"2026-08-07T05:45:56.026292Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T05:51:06.912405Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":5,"verified_fuzzy":36},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 6 inbound Pith citation observations for arXiv:2506.07214."}