{"as_of":"2026-08-08T03:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b6e972ae3ba2c953e8347cc46b3c4cdcd19464e181f922ae9899aefe97950a6c","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:02:15.122716Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-17T04:15:38.632039Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-17T04:19:00.663878Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"cited_work":{"arxiv_id":"2507.23202","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23202","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adversarial-guided diffusion for multimodal llm attacks","venue":null,"work_id":"e69d17a3-e7fd-4729-b993-d7159cb47f11","year":2025},"citing_paper":{"arxiv_id":"2511.21893","last_updated":"2026-04-21T12:31:10Z","snapshot_observed_at":"2026-08-02T23:18:14.454521Z","submitted_at":"2025-11-26T20:18:20Z","title":"Breaking the Illusion: Consensus-Based Generative Mitigation of Adversarial Illusions in Multi-Modal Embeddings","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-17T04:15:38.632039Z"},"links":{"cited_paper":"/paper/2507.23202","citing_paper":"/paper/2511.21893"},"observation_digest":"sha256:faef700b25d8431278918ba46321534934ae44654498a4c0423c4411405f761e","observation_id":"caf603f1-7592-4b30-b0be-4309dec69664","resolution":{"observed_at":"2026-05-17T04:19:00.669610Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.23202/citation-record","integrity":"/paper/2507.23202/integrity","json":"/paper/2507.23202/citation-record.json","paper":"/paper/2507.23202"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.00236","last_updated":"2024-09-17T19:56:09Z","snapshot_observed_at":"2026-08-06T06:17:45.496933Z","submitted_at":"2023-09-01T03:53:40Z","title":"Image Hijacks: Adversarial Images can Control Generative Models at Runtime","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00236","snapshot_observed_at":"2026-08-06T11:02:14.914452Z","title":"Image hijacks: Adversarial images can control generative models at runtime","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.914452Z"},"links":{"cited_paper":"/paper/2309.00236","citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:de7879b0003ab8c58dfa95eb68f7707ffb63b883b59c07bb3b643892366bacad","observation_id":"355b679a-62d3-4fc7-9471-be2b086b490b","resolution":{"observed_at":"2026-08-06T11:02:14.914452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.822384Z","title":"One transformer fits all distributions in multi-modal diffusion at scale","venue":null,"work_id":"a933d4b8-1c20-45a4-9e20-6fb843e85e67","year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.919697Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:780670b82589e0754fa1c09115038d85465e0e16420dec0a27f286e6fdb92c35","observation_id":"c62a5ea3-2c0e-4f90-b56d-9a999fc89421","resolution":{"observed_at":"2026-08-06T11:02:15.827406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.807178Z","title":"A young boy is playing with a baseball bat A blue bird sitting on a tree branch","venue":null,"work_id":"b9a5f978-f075-49fb-a9cc-cc61f0061d5f","year":null},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.924173Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:594048d0ad5522ab6052b97a8d58fd6f68c890396bf50744c36dad510d0a6222","observation_id":"ed2edd90-7dc1-4ab1-9044-a9fe90407b89","resolution":{"observed_at":"2026-08-06T11:02:15.812072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.791549Z","title":"Content-based unrestricted ad- versarial attack","venue":null,"work_id":"c5adf899-ffca-41f8-8eae-3a700965397b","year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.928773Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:01fd8b98eb617b2a82e764a22b50282d0c00985f352c5511601b58c9ef6e0606","observation_id":"8cfd7638-7b51-4029-b89f-d3b4623b3371","resolution":{"observed_at":"2026-08-06T11:02:15.796284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:14.933642Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90%* chatgpt quality","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.933642Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:078bfd6adf6a32b7cea92ac6c947253fa1d71dd5243aba1558e2b10a9409133d","observation_id":"43c1d343-721e-4c9b-9976-bf266da9df9c","resolution":{"observed_at":"2026-08-06T11:02:14.933642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.767231Z","title":"On the robustness of large multimodal models against image adversarial attacks","venue":null,"work_id":"479cd052-c48a-4e2c-bc97-65c7f47de2af","year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.938383Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:73fd65423a40ce937f71d8c130bfecd2d10d0d4f203d363ffedc2b48b785206e","observation_id":"7da7aae7-cc41-4aad-a373-23eae82ad1ae","resolution":{"observed_at":"2026-08-06T11:02:15.771932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.752201Z","title":"Advdiff: Gener- ating unrestricted adversarial examples using diffusion mod- els","venue":null,"work_id":"e37a9c5a-ce4e-4082-b052-30ca12de96bc","year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.942989Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:40359da465e8340ad0f703d53e5d51ab666f74dec6cfd723da821d5b0306c72f","observation_id":"ea777a4e-a16d-430e-913a-37b9db5a75a3","resolution":{"observed_at":"2026-08-06T11:02:15.756979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.738078Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"eee9ccd6-840c-4547-a525-9ddc0f7f0cad","year":2009},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.948000Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:185dd9aac810841248fa9d66e9616a594d93a5307c04e10a9ccdb760af4fe959","observation_id":"a9e5bb1a-6779-4920-9501-d2b71f216fbf","resolution":{"observed_at":"2026-08-06T11:02:15.742560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.723036Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":"ea6cf73e-c64e-4840-9abc-b47a9f64cbeb","year":null},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.952243Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:2d179899ca918c230ce84774dd4ce2224900c05eaf752c9c5bdeeea976727896","observation_id":"1eff578d-0d10-405b-8c4a-a89b2f974b38","resolution":{"observed_at":"2026-08-06T11:02:15.728424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.707611Z","title":"Boosting adversarial attacks with momentum","venue":null,"work_id":"ffbf08ea-1fa1-44f7-abd0-f9fca12f7c0e","year":2018},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.956655Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:7d3e94b2ac2defdf09be2d7e0982b7f3630862a2905632695ca99b07c134c389","observation_id":"d39f371d-39c2-4fbd-9777-b201dad081b0","resolution":{"observed_at":"2026-08-06T11:02:15.712765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11751","last_updated":"2023-10-14T12:56:13Z","snapshot_observed_at":"2026-08-02T21:47:41.540245Z","submitted_at":"2023-09-21T03:24:30Z","title":"How Robust is Google's Bard to Adversarial Image Attacks?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11751","snapshot_observed_at":"2026-08-06T11:02:14.960784Z","title":"How robust is Google’s bard to adversarial image attacks? arXiv preprint arXiv:2309.11751, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.960784Z"},"links":{"cited_paper":"/paper/2309.11751","citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:054e55f39c9941444004346d9f8cd7de895c803cd56ab7c39faee28b673561bb","observation_id":"b9826d94-4775-43a8-a039-7694b7706696","resolution":{"observed_at":"2026-08-06T11:02:14.960784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.691982Z","title":"Boosting transferability in vision-language attacks via diversification along the intersection region of adversarial trajectory","venue":null,"work_id":"1aa49f1e-2f1e-4a3d-850e-0b3a445ca2a9","year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.965401Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:344431285e35bc0e6742e7acc0f49031a70611d4a199be686d22fde21a5f0a2f","observation_id":"5e114afd-e268-4d72-9ac3-ab5fad0b6b42","resolution":{"observed_at":"2026-08-06T11:02:15.696870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6572","last_updated":"2015-03-20T20:19:16Z","snapshot_observed_at":"2026-07-06T04:04:16.777653Z","submitted_at":"2014-12-20T01:17:12Z","title":"Explaining and Harnessing Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6572","snapshot_observed_at":"2026-08-06T11:02:14.969893Z","title":"Explaining and harnessing adversarial examples","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.969893Z"},"links":{"cited_paper":"/paper/1412.6572","citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:c044e16e13b8d560c684c4ef695480c2c26e6e77c0f1e856b04c5d82fe41636f","observation_id":"9d98356a-7fe0-4169-8c65-0819517a3348","resolution":{"observed_at":"2026-08-06T11:02:14.969893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.677882Z","title":"Countering adversarial images using input transformations","venue":null,"work_id":"262b2f84-a115-4b5c-8932-cecee494b305","year":2018},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.974390Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:cad37abf62804f7c2c4fff620451d6ae4d22f8fb2fa792e1ffe6050899353db4","observation_id":"40094e0f-ff89-48d0-9b8b-b0e40e089cca","resolution":{"observed_at":"2026-08-06T11:02:15.682257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.664034Z","title":"Efficient generation of targeted and transferable adversarial examples for vision-language models via diffusion models","venue":null,"work_id":"09b53975-0eaf-4795-93ce-d1ed0e79fd5c","year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.978534Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:dc197f69373819174110ea9bffaf74ca8514c9146c4561b729dccd885cf07cc0","observation_id":"8f08cde7-e584-4a2b-92af-41595ce571b0","resolution":{"observed_at":"2026-08-06T11:02:15.668808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08718","last_updated":"2022-03-23T19:47:21Z","snapshot_observed_at":"2026-07-06T11:01:02.207193Z","submitted_at":"2021-04-18T05:00:29Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08718","snapshot_observed_at":"2026-08-06T11:02:14.982876Z","title":"Clipscore: A reference-free evaluation metric for image captioning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.982876Z"},"links":{"cited_paper":"/paper/2104.08718","citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:fe7ff68c553d39b221349c13030f92e0e13e9ac42172dc039d7a2a27c7624022","observation_id":"ce8e715b-987c-4036-b6a3-0bdd58c39024","resolution":{"observed_at":"2026-08-06T11:02:14.982876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.650119Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":"150ce434-fe01-4e44-b11a-cf72c9455ffd","year":null},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.987951Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:8d442191e612dde40e568ff3328cc72fecce801e1f2330f8c319bf0f81e82d9a","observation_id":"cbeb103f-dd5f-447a-9cba-fe9f26260fd9","resolution":{"observed_at":"2026-08-06T11:02:15.654654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.635800Z","title":"Image quality metrics: PSNR vs","venue":null,"work_id":"f8cf883e-b1ef-4826-acf1-4502e224ab6c","year":2010},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.992391Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:61a67cda4c0538c5ddb204187a37308031f3abf28da0733e5df415da75045be2","observation_id":"a0fd4630-ad7e-431b-b88f-6d86aa957d1e","resolution":{"observed_at":"2026-08-06T11:02:15.640388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.621993Z","title":"An edit friendly DDPM noise space: Inversion and manipulations","venue":null,"work_id":"09328081-9501-45e9-a52e-186294d37ecf","year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:14.996573Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:a36100fbc4553683898ea0951f703e2900b24eef026ba02f4ac55cba95d74bc2","observation_id":"214fd654-b65c-4003-abec-a7aedbf41fd1","resolution":{"observed_at":"2026-08-06T11:02:15.626446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.608042Z","title":"Adver- sarial examples in the physical world","venue":null,"work_id":"b96e0fb7-0b98-418e-a72a-802ed6bc7f2c","year":null},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.000693Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:0eed9476c95556b81136f4260c651cb1ac46d80c7790856f94b4d1d8ad021258","observation_id":"408d3b56-bf24-4c99-aaff-e5bc562280d8","resolution":{"observed_at":"2026-08-06T11:02:15.612897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.593733Z","title":"BLIP- 2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"d50b5dc6-7ca2-4756-831e-3cfa682b501a","year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.005414Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:e75f7f42629f723a277d0aaeffba461572f3d790acd61c82db0c2f505e87af20","observation_id":"31427e88-15fd-4926-98db-31adef6eef64","resolution":{"observed_at":"2026-08-06T11:02:15.598359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.579506Z","title":"Alleviating exposure bias in diffusion mod- els through sampling with shifted time steps","venue":null,"work_id":"d316026d-09a0-492a-ad0d-1586b92a3025","year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.009806Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:e9882f2d1bf64f41e1d90b716c02ccf1400c04ba5ee2874592c41cb96142fec5","observation_id":"f1c3f962-7457-467b-b8c6-4ffac2d56bda","resolution":{"observed_at":"2026-08-06T11:02:15.584000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.565475Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":"53a8838c-3a20-4e9c-b68e-4986bfd3f6e4","year":2014},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.014163Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:2a8026ddacd2d0de11ea74d3cf4491156e8b432ef96e38cf9fba2bfb5dc43723","observation_id":"ef11b07c-9782-4cb0-8a28-b5528660f3fc","resolution":{"observed_at":"2026-08-06T11:02:15.569838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.551413Z","title":"Visual instruction tuning","venue":null,"work_id":"f3d41a26-8b88-4fc8-9339-05cd0b6fa0b5","year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.019017Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:19397c4d17de4ae8a8023c01eba1339c90868bb571453b55ba5dfab5f3f9dd16","observation_id":"cbbef974-6413-46e9-ba9d-e167a530eea9","resolution":{"observed_at":"2026-08-06T11:02:15.556325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.537597Z","title":"An image is worth 1000 lies: Transferability of adversarial images across prompts on vision-language models","venue":null,"work_id":"12cef416-43c3-4420-8107-3b3241415556","year":null},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.023457Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:fb07dd1bd50b8487644824a2adf186f0808d61a636132659b5c92bac82f0b63a","observation_id":"5c7dc2c4-804f-4b44-9a9b-965a6527b0c3","resolution":{"observed_at":"2026-08-06T11:02:15.542148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.523273Z","title":"Towards deep learning models resistant to adversarial attacks","venue":null,"work_id":"5eefabaa-96a5-4c72-8b3b-bed878602cf6","year":2018},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.028438Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:1578bd762fb5a2303c8a1285bcb9cac32f504bb1c113852fc247f4f05c704ff8","observation_id":"f4a17c9f-5bb1-4c49-be9b-dce19e67ce83","resolution":{"observed_at":"2026-08-06T11:02:15.527782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.508185Z","title":"Diffusion models for adver- sarial purification","venue":null,"work_id":"44bd6c1f-f000-4053-9a84-71968b3a284e","year":2022},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.033195Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:7c19f92dabc8156223805499a5d7df3a4a8d8f9174ee0a38a17ea622e479dad2","observation_id":"50ea609c-f535-4734-a01c-524e94c74e70","resolution":{"observed_at":"2026-08-06T11:02:15.513080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.492460Z","title":"Elucidating the exposure bias in diffusion models","venue":null,"work_id":"5505adb2-e54c-4d99-aeec-027b793dbd1a","year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.037541Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:63998f35df75b5526ffc8a0dfd08a71b926c17a6e29e8fca3533e16e07b2693f","observation_id":"a511cb04-afc6-4ed2-a4ea-1e941ae13228","resolution":{"observed_at":"2026-08-06T11:02:15.497478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.477642Z","title":"Diffusion-based adversarial purification from the perspective of the frequency domain","venue":null,"work_id":"bddb32f2-2187-4c01-bb6f-8197bf808cf7","year":2025},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.042482Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:b5996540cd3e2aea7a8873072bd1f6ab4c82adb9b810eac4c9af46e4f4ef0164","observation_id":"1bb54fcc-389b-4a0d-9855-660aba02800d","resolution":{"observed_at":"2026-08-06T11:02:15.482788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.462554Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"0dc96253-7270-422e-9c71-6c3b51e95115","year":2021},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.046817Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:93e387630a31a91aaca75a95cc470492e26bd4aa8bf0789956e4c5f892aa5360","observation_id":"727d9050-e03a-4864-b857-6dd747222847","resolution":{"observed_at":"2026-08-06T11:02:15.467217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.446051Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"cb88d703-b2af-4676-9c1e-edf40088e390","year":2022},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.051033Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:5868681c014ca5f2a1ace2a38ac08eee8113a790fc04a90f1e55c3ff8091f438","observation_id":"31e551c4-e73d-466f-b09d-3b1e7e34cac1","resolution":{"observed_at":"2026-08-06T11:02:15.450877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.430727Z","title":"On the adversarial robustness of multi-modal foundation models","venue":null,"work_id":"7901c57d-e162-418b-b12f-4c1ac1645bcb","year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.055298Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:5806ac593c13443d8946cf7d57c7a49b5cd855b6e65b191aacb2cc9f69cb78b3","observation_id":"3bd7ad07-2919-4afa-8849-02fb81a9afe1","resolution":{"observed_at":"2026-08-06T11:02:15.435503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.415767Z","title":"Colorfool: Semantic adversarial colorization","venue":null,"work_id":"b5a22544-f7fd-43de-b5ed-7b648f0faab7","year":2020},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.059455Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:0b8392f25a91cc4200289cdc2ad8d905d3e78cd272f124e484bb0bb8c4a44644","observation_id":"1d2d9dd0-1b31-4405-b770-07d3b477b859","resolution":{"observed_at":"2026-08-06T11:02:15.420741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.400348Z","title":"Jail- break in pieces: Compositional adversarial attacks on multi- modal language models","venue":null,"work_id":"aa935947-fd53-4214-bec6-2894a6fd1465","year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.063593Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:cf98886e7576b3041144258be6c02b8822e5ec1f0df098f04c862b8c225551f4","observation_id":"bc3e488a-5e85-4808-841d-5d189f4a3b79","resolution":{"observed_at":"2026-08-06T11:02:15.405081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.385345Z","title":"Online adver- sarial purification based on self-supervised learning","venue":null,"work_id":"8e2ea892-560d-4309-9493-1c02be3af9b3","year":null},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.067644Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:b3837e353094befb3a98a40d868664cb7a53b258546d15b6a8122120a62636aa","observation_id":"bae917c7-7b58-45f1-b9d2-f7f48a7068ad","resolution":{"observed_at":"2026-08-06T11:02:15.390395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.072519Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.072519Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:905d72f66e035c22ae5e250be146bbbbcb1ab08b40d1d85bbb6372a56dc0e1f7","observation_id":"c00f31dc-710f-408c-a5d4-0bc5bacad6cd","resolution":{"observed_at":"2026-08-06T11:02:15.072519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.359948Z","title":"Mimicd- iffusion: Purifying adversarial perturbation via mimicking clean diffusion model","venue":null,"work_id":"31d76221-5080-4d77-ba4d-692d2d599455","year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.077053Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:9fcf60afb952900954ab7ad8ffd1601842f6e7ac5765c005e0a178d47dc31a27","observation_id":"3c2e1d6e-1a51-4457-be0e-0384a7c229e4","resolution":{"observed_at":"2026-08-06T11:02:15.364656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.343808Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":"f4abaeec-2d4c-42ab-895b-476001e42881","year":2021},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.081923Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:71f7f817d8b79fe0676663f2198fde2d3894ec813ddd308ebd0566b63e3d0dc0","observation_id":"f65b2e99-3099-4cde-b75c-80ce463fffd3","resolution":{"observed_at":"2026-08-06T11:02:15.348642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T11:02:15.086370Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.086370Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:6658132fe3b2b8b11f3a816333a3c384e98ba787943dbc569f0daa022b2db3af","observation_id":"c98a7ae5-613d-45d5-8ff1-b16b0535429f","resolution":{"observed_at":"2026-08-06T11:02:15.086370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01886","last_updated":"2024-06-26T03:29:50Z","snapshot_observed_at":"2026-08-03T09:13:22.955433Z","submitted_at":"2023-12-04T13:40:05Z","title":"InstructTA: Instruction-Tuned Targeted Attack for Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01886","snapshot_observed_at":"2026-08-06T11:02:15.091090Z","title":"Instructta: Instruction-tuned targeted attack for large vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.091090Z"},"links":{"cited_paper":"/paper/2312.01886","citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:fe740cf94afb50fe085990f27a5ceb1a93193dba5db8a4947db5d67fef7e33be","observation_id":"14958a04-56bc-472c-8388-e05fc11b603e","resolution":{"observed_at":"2026-08-06T11:02:15.091090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.329004Z","title":"Image quality assessment: from error visibility to structural similarity","venue":null,"work_id":"2d8447d4-5daa-42a6-9c99-0192312bd10c","year":2004},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.095902Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:ca682ab7d93bc5c0322de957a74017d5e95182ca705d935c29c8e9dc62186284","observation_id":"33d31752-896c-474b-95cd-dfce17e8229b","resolution":{"observed_at":"2026-08-06T11:02:15.333637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.314475Z","title":"Mitigating adversarial effects through random- ization","venue":null,"work_id":"ef43c7dc-b1ee-4043-94d0-894f7f94b660","year":2018},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.100361Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:e3e69daa3bf2466c66178aa52f388baeb5819f9ce4b9481a149a434314393e3e","observation_id":"bc8304a8-8afa-4303-aa18-e2cdd28a4522","resolution":{"observed_at":"2026-08-06T11:02:15.319280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.299734Z","title":"Chain of attack: On the robustness of vision-language models against transfer-based adversarial attacks","venue":null,"work_id":"e67d48fe-73cc-417e-92fd-1711b19489b1","year":2025},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.104925Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:cef9fee227dd257b3b58dc87d2ab820f07ec4a2a7f6c04b443c23869ddf0a1e3","observation_id":"5d5a302d-2b00-4e73-a96b-f4b036e5c619","resolution":{"observed_at":"2026-08-06T11:02:15.304421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.284827Z","title":"Natural color fool: Towards boosting black-box unrestricted attacks","venue":null,"work_id":"98f1b97b-7d21-4e44-96b2-d2fe9ceee135","year":null},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.109240Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:1f26d172ff1f4050c7fe2c7a0b12b110de09d8dc83fe99f15927dfe017128758","observation_id":"82f6430f-0593-4b79-bf21-46030dd5cbf3","resolution":{"observed_at":"2026-08-06T11:02:15.289407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.113841Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.113841Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:2cb70934ebeb6601ca8b532b6346adbf97aeea5993738854e66dd5944b13580a","observation_id":"d4166f59-ccd9-45ee-b60e-297ded55cfd8","resolution":{"observed_at":"2026-08-06T11:02:15.113841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:02:15.259088Z","title":"On evaluating adversarial robustness of large vision-language models","venue":null,"work_id":"7c40259f-8819-4976-89fb-dc351dd2f5b6","year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.118427Z"},"links":{"citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:3438021a81a4e364b9ddc2a8bdfbd52f085dd673df5874fec444db253ced7dd5","observation_id":"3fa3b325-939b-4483-95ea-83374ebd26af","resolution":{"observed_at":"2026-08-06T11:02:15.265738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-06T11:02:15.122716Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T11:02:15.122716Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2507.23202"},"observation_digest":"sha256:54af398ad110b964267a34c61e53cb58dbb67c2f0016cd37ce44126865ab4f6a","observation_id":"dcbb0c16-2e8a-4ace-a906-50d3e31250c2","resolution":{"observed_at":"2026-08-06T11:02:15.122716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.23202","last_updated":"2025-07-31T02:57:20Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T11:02:14.318007Z","submitted_at":"2025-07-31T02:57:20Z","title":"Adversarial-Guided Diffusion for Multimodal LLM Attacks"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":37},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 1 inbound Pith citation observation for arXiv:2507.23202."}