{"as_of":"2026-08-13T10:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:740b27947ccdc595d7d87fa0a99351f31d6e285f2b83e2a75711fdf692ad254c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":32,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T20:53:14.936399Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-12T20:53:14.936399Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language models via role-playing image characte,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09259","last_updated":"2024-12-09T14:22:14Z","snapshot_observed_at":"2026-08-12T23:36:02.637309Z","submitted_at":"2024-11-14T07:51:51Z","title":"Jailbreak Attacks and Defenses against Multimodal Generative Models: A Survey","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T20:53:14.936399Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2411.09259"},"observation_digest":"sha256:d7c82824beb7c4fd8ad1dee8ce850ae29d505d62cea4be115662eb458ab011c1","observation_id":"3f23ffd3-82e0-4ae1-a2ff-a6a6a0ea3742","resolution":{"observed_at":"2026-08-12T20:53:14.936399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-12T14:24:32.531856Z","title":"Visual-roleplay: Univer- sal jailbreak attack on multimodal large language models via role-playing image characte","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16721","last_updated":"2025-05-01T22:22:43Z","snapshot_observed_at":"2026-08-12T20:52:46.818285Z","submitted_at":"2024-11-23T02:17:17Z","title":"Steering Away from Harm: An Adaptive Approach to Defending Vision Language Model Against Jailbreaks","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:32.531856Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2411.16721"},"observation_digest":"sha256:51c7832ccf65c7b21c822ff79afda6a57aaa50df76dff8bc8db0a0993a2fd02e","observation_id":"275cc0c3-64c3-4bdd-923c-e4d1691b24e5","resolution":{"observed_at":"2026-08-12T14:24:32.531856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-11T10:32:28.295755Z","title":"Visual-roleplay: Uni- versal jailbreak attack on multimodal large language models via role-playing image characte.arXiv preprint arXiv:2405.20773, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16555","last_updated":"2025-05-29T14:05:50Z","snapshot_observed_at":"2026-08-13T09:14:52.412357Z","submitted_at":"2024-12-21T09:43:51Z","title":"Divide and Conquer: A Hybrid Strategy Defeats Multimodal Large Language Models","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:28.295755Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2412.16555"},"observation_digest":"sha256:7109558b3b10a3c9850948e46df152d7490905db84ce6b6ae7c3238576c8ee4b","observation_id":"e3b24ad5-4c12-46d1-ba32-413f9cc03941","resolution":{"observed_at":"2026-08-11T10:32:28.295755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-10T14:29:28.074482Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language models via role-playing image char- acte","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15269","last_updated":"2025-01-25T16:36:00Z","snapshot_observed_at":"2026-08-11T16:16:46.058658Z","submitted_at":"2025-01-25T16:36:00Z","title":"Mirage in the Eyes: Hallucination Attack on Multi-modal Large Language Models with Only Attention Sink","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-10T14:29:28.074482Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2501.15269"},"observation_digest":"sha256:d4cbe57335a4d7b0bf95a85f1d1530dfc8fba917995fd27ddb626cf235b9776e","observation_id":"d06010ab-dcd7-464f-9472-a6daabaff6c6","resolution":{"observed_at":"2026-08-10T14:29:28.074482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":"2405.20773","doi":"10.48550/arxiv.2405.20773","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language mod- els via role-playing image character","venue":"arXiv (Cornell University)","work_id":"cfff0289-3100-466e-9e4e-d6998de6b0b4","year":2022},"citing_paper":{"arxiv_id":"2502.05206","last_updated":"2026-04-14T16:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-02T05:14:22Z","title":"Safety at Scale: A Comprehensive Survey of Large Model and Agent Safety","version":6},"reference_index":283,"source":"pdf_text","source_observed_at":"2026-05-23T04:39:04.591722Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2502.05206"},"observation_digest":"sha256:5a1ec6e495a723e32d3b0f5960ee0f678c724620d430239153d19702f3fe9dd2","observation_id":"11d35ee0-45f9-4f58-9bdd-aea793577148","resolution":{"observed_at":"2026-05-23T04:42:34.086175Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-08T15:38:17.089320Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image character,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06390","last_updated":"2025-02-11T04:42:24Z","snapshot_observed_at":"2026-08-09T09:14:59.400822Z","submitted_at":"2025-02-10T12:20:08Z","title":"When Data Manipulation Meets Attack Goals: An In-depth Survey of Attacks for VLMs","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T15:38:17.089320Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2502.06390"},"observation_digest":"sha256:5869714af359dcb83276692ba28f3e69bf3087b0785d47248ff47f6b6eb32929","observation_id":"631adf9a-90c7-43e1-ae22-9610b9e7c1ea","resolution":{"observed_at":"2026-08-08T15:38:17.089320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-08T11:17:01.654636Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07987","last_updated":"2025-06-04T18:10:51Z","snapshot_observed_at":"2026-08-09T07:48:53.248560Z","submitted_at":"2025-02-11T22:07:47Z","title":"Universal Adversarial Attack on Aligned Multimodal LLMs","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T11:17:01.654636Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2502.07987"},"observation_digest":"sha256:4b754d31c70b9e33d280ab38dc7f8c8cf336648c262c2fd642d4741a068fb0e0","observation_id":"f7fb9fc0-da95-4b8a-b745-96f5d8022a25","resolution":{"observed_at":"2026-08-08T11:17:01.654636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-07T19:45:19.478474Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image characte,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.14881","last_updated":"2025-02-14T08:42:43Z","snapshot_observed_at":"2026-08-12T22:07:51.112849Z","submitted_at":"2025-02-14T08:42:43Z","title":"A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations","version":1},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-08-07T19:45:19.478474Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2502.14881"},"observation_digest":"sha256:34c088d43f5777d6c1802a9bbba01ea465322afd6eb0f3302b903164f96ec07f","observation_id":"2983a16f-e1b5-4204-a268-c3055cc3eced","resolution":{"observed_at":"2026-08-07T19:45:19.478474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":"2405.20773","doi":"10.48550/arxiv.2405.20773","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language mod- els via role-playing image character","venue":"arXiv (Cornell University)","work_id":"cfff0289-3100-466e-9e4e-d6998de6b0b4","year":2022},"citing_paper":{"arxiv_id":"2503.06223","last_updated":"2026-08-06T06:47:13Z","snapshot_observed_at":"2026-08-09T23:09:10.814238Z","submitted_at":"2025-03-08T13:51:40Z","title":"RedDiffuser: Auditing Multimodal Safety Failures in Vision-Language Models via Reinforced Diffusion","version":5},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-23T00:13:08.603115Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2503.06223"},"observation_digest":"sha256:579f594b12b54a9514dc470659377e900abaea034ba05bee2d5c06d8a81f12cd","observation_id":"8e654e81-4eeb-4fc4-9474-7c49d04a16fd","resolution":{"observed_at":"2026-05-23T00:15:14.824301Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-07T14:56:53.654176Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language models via role-playing image characte.arXiv preprint arXiv:2405.20773, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16916","last_updated":"2025-05-22T17:11:58Z","snapshot_observed_at":"2026-08-09T17:32:27.997542Z","submitted_at":"2025-05-22T17:11:58Z","title":"Backdoor Cleaning without External Guidance in MLLM Fine-tuning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:53.654176Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2505.16916"},"observation_digest":"sha256:c1e88a8e8068a9873fb009485f98543da6218ceb6ffca0fdf146a73c0f4a4a02","observation_id":"db1cdf8a-433a-4028-a163-02d76706a3b6","resolution":{"observed_at":"2026-08-07T14:56:53.654176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-07T14:52:15.961141Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image characte","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18212","last_updated":"2025-05-22T22:06:09Z","snapshot_observed_at":"2026-08-13T01:25:59.957395Z","submitted_at":"2025-05-22T22:06:09Z","title":"Towards medical AI misalignment: a preliminary study","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:52:15.961141Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2505.18212"},"observation_digest":"sha256:f0c31255ed38dc883d97ae38299825261fdd71fb2e4f1b2a00ce949455683700","observation_id":"8e8cf2df-b10e-489a-ac96-bc15025f4f03","resolution":{"observed_at":"2026-08-07T14:52:15.961141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-07T13:22:01.801888Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21967","last_updated":"2025-05-28T04:43:39Z","snapshot_observed_at":"2026-08-08T01:18:33.252536Z","submitted_at":"2025-05-28T04:43:39Z","title":"Seeing the Threat: Vulnerabilities in Vision-Language Models to Adversarial Attack","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:01.801888Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2505.21967"},"observation_digest":"sha256:53e5d8d0882d22dda1dd766045f27992431c6514ab7d450fe2dd54ca000260a1","observation_id":"175db9d6-728f-4140-a7eb-cb7830d3e6b1","resolution":{"observed_at":"2026-08-07T13:22:01.801888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-07T00:57:13.747840Z","title":"4711–4728, Philadelphia, PA, August 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12430","last_updated":"2025-07-11T02:01:54Z","snapshot_observed_at":"2026-08-09T20:22:46.693664Z","submitted_at":"2025-06-14T10:03:17Z","title":"Pushing the Limits of Safety: A Technical Report on the ATLAS Challenge 2025","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:13.747840Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2506.12430"},"observation_digest":"sha256:11d118f6e1c8d958047710731eb116d1900c035feca59bea049d3880ea2a1767","observation_id":"c2d64ec6-2de9-4e5a-b235-bc0f4f94626a","resolution":{"observed_at":"2026-08-07T00:57:13.747840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T23:13:05.101293Z","title":"arXiv preprint arXiv:2405.20773 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05775","last_updated":"2026-07-27T20:50:40Z","snapshot_observed_at":"2026-08-10T01:02:48.484224Z","submitted_at":"2025-08-07T18:42:16Z","title":"Guardians and Offenders: A Survey on Harmful Content Generation and Safety Mitigation of LLM","version":3},"reference_index":184,"source":"arxiv_source","source_observed_at":"2026-08-05T23:13:05.101293Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2508.05775"},"observation_digest":"sha256:74b665a5384b6ef97ce13a35d618a874fc6d05b93fe5d3d6be0bb0a100df10a4","observation_id":"b9874aa5-95cf-4190-b522-76878372fe42","resolution":{"observed_at":"2026-08-05T23:13:05.101293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T22:21:02.811865Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image character.arXiv preprint arXiv:2405.20773,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09206","last_updated":"2025-08-10T00:55:54Z","snapshot_observed_at":"2026-08-10T10:40:44.843068Z","submitted_at":"2025-08-10T00:55:54Z","title":"The First Differentiable Transfer-Based Algorithm for Discrete MicroLED Repair","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:02.811865Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2508.09206"},"observation_digest":"sha256:b5bb1ec841babf6d2ac963ee2df3efec8acfbd14ba6d29265f50d7560521aae7","observation_id":"7427c66f-c0ee-49c1-b825-77a9ac21efee","resolution":{"observed_at":"2026-08-05T22:21:02.811865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T21:22:37.649627Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image characte.arXiv preprint arXiv:2405.20773,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.09237","last_updated":"2025-08-12T12:11:43Z","snapshot_observed_at":"2026-08-08T17:20:22.464472Z","submitted_at":"2025-08-12T12:11:43Z","title":"Blockchain Network Analysis using Quantum Inspired Graph Neural Networks & Ensemble Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T21:22:37.649627Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2508.09237"},"observation_digest":"sha256:340e20648de13d533f5640ccaaad9c634dc5169ef85076fcf0c1267823a5b90c","observation_id":"f0fab43f-50a9-42b8-9577-5e536a723db5","resolution":{"observed_at":"2026-08-05T21:22:37.649627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T20:29:06.482070Z","title":"Ma et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10955","last_updated":"2025-08-14T07:25:45Z","snapshot_observed_at":"2026-08-09T12:54:37.629481Z","submitted_at":"2025-08-14T07:25:45Z","title":"Empowering Multimodal LLMs with External Tools: A Comprehensive Survey","version":1},"reference_index":231,"source":"arxiv_source","source_observed_at":"2026-08-05T20:29:06.482070Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2508.10955"},"observation_digest":"sha256:f2bb7e91a7cb5189637aba9f0f4466a99b8630f018ef30af00a72ad1ff91ef44","observation_id":"507b2e82-a73e-4034-8334-7fa17ee9e1e8","resolution":{"observed_at":"2026-08-05T20:29:06.482070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T16:00:48.746871Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image character, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19445","last_updated":"2026-06-16T17:34:06Z","snapshot_observed_at":"2026-08-08T05:25:02.825611Z","submitted_at":"2025-08-26T21:36:45Z","title":"On Surjectivity of Neural Networks: Can you elicit any behavior from your model?","version":3},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-05T16:00:48.746871Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2508.19445"},"observation_digest":"sha256:e9138ef9cd8e6c37125c726a6b9d67a712c76283ff40d04b9484653b8bd86ed3","observation_id":"672e6be8-72ed-474c-b237-579cc9d71b9e","resolution":{"observed_at":"2026-08-05T16:00:48.746871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-04T09:25:50.007530Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image characte.CoRR, abs/2405.20773, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.15476","last_updated":"2026-07-04T04:20:15Z","snapshot_observed_at":"2026-08-06T02:45:04.316908Z","submitted_at":"2025-10-17T09:38:54Z","title":"SoK: Systematizing LLM Prompt Security: Taxonomies, Datasets, and Unified Evaluation of Attacks and Defenses","version":3},"reference_index":133,"source":"pdf_text","source_observed_at":"2026-08-04T09:25:50.007530Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2510.15476"},"observation_digest":"sha256:0c942e3cfe29a690668ad319020ab523623f504fd453a3e556686330373c50d2","observation_id":"d5be7c2a-2861-4dfc-a5c9-102b6a476f91","resolution":{"observed_at":"2026-08-04T09:25:50.007530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-04T09:02:38.637172Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image character","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.17759","last_updated":"2026-05-26T07:09:27Z","snapshot_observed_at":"2026-08-12T23:36:02.333353Z","submitted_at":"2025-10-20T17:12:10Z","title":"VERA-V: Variational Inference Framework for Jailbreaking Vision-Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T09:02:38.637172Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2510.17759"},"observation_digest":"sha256:4caa694b8fd1f9956ad247c36b0f856a3f2958255c5e931280f86146816818d8","observation_id":"59cd7582-ec3a-4e5a-9246-11362bc47eb0","resolution":{"observed_at":"2026-08-04T09:02:38.637172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-02T23:16:36.824638Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image character.arXiv preprint arXiv:2405.20773,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14399","last_updated":"2026-05-28T04:31:34Z","snapshot_observed_at":"2026-08-06T22:03:52.645334Z","submitted_at":"2026-02-16T02:15:58Z","title":"Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T23:16:36.824638Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2602.14399"},"observation_digest":"sha256:139fa726b3fc7d9b00f864f54ba01481fceb06802c132ec3d8a6ef376b5f50ad","observation_id":"f036b930-a299-47f6-ba77-7ab84fc7cea0","resolution":{"observed_at":"2026-08-02T23:16:36.824638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":"2405.20773","doi":"10.48550/arxiv.2405.20773","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language mod- els via role-playing image character","venue":"arXiv (Cornell University)","work_id":"cfff0289-3100-466e-9e4e-d6998de6b0b4","year":2022},"citing_paper":{"arxiv_id":"2604.06950","last_updated":"2026-04-09T01:50:11Z","snapshot_observed_at":"2026-08-11T17:00:39.376798Z","submitted_at":"2026-04-08T11:13:16Z","title":"Making MLLMs Blind: Adversarial Smuggling Attacks in MLLM Content Moderation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T18:19:58.970952Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2604.06950"},"observation_digest":"sha256:9ee290da7e9864cd64d71d15aec1a46e719c91fe6af91146faec298b94e8b24e","observation_id":"f22ac78a-055d-4254-a4df-a8e26b4706be","resolution":{"observed_at":"2026-05-11T00:45:50.274862Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":"2405.20773","doi":"10.48550/arxiv.2405.20773","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language mod- els via role-playing image character","venue":"arXiv (Cornell University)","work_id":"cfff0289-3100-466e-9e4e-d6998de6b0b4","year":2022},"citing_paper":{"arxiv_id":"2604.08846","last_updated":"2026-04-10T01:01:56Z","snapshot_observed_at":"2026-08-02T14:54:38.934183Z","submitted_at":"2026-04-10T01:01:56Z","title":"Dictionary-Aligned Concept Control for Safeguarding Multimodal LLMs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T18:04:05.157103Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2604.08846"},"observation_digest":"sha256:37d689d208e2e9d55211099c15f094867e8fb95641c9ffddaa6e65a12cc47d59","observation_id":"92aad731-47a5-4fca-8760-fc4a54da3ee5","resolution":{"observed_at":"2026-05-11T05:35:57.164743Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":"2405.20773","doi":"10.48550/arxiv.2405.20773","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language mod- els via role-playing image character","venue":"arXiv (Cornell University)","work_id":"cfff0289-3100-466e-9e4e-d6998de6b0b4","year":2022},"citing_paper":{"arxiv_id":"2604.08881","last_updated":"2026-07-30T10:00:35Z","snapshot_observed_at":"2026-08-11T03:10:45.292504Z","submitted_at":"2026-04-10T02:42:52Z","title":"Targeted Interpretable Safety Neuron Enhancement for Multilingual Vision-Language Large Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T18:12:34.909229Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2604.08881"},"observation_digest":"sha256:53ce36ccea03260db0a95ef652111c62bb2e5c2b15a33a170c18bc864426e2e3","observation_id":"83a652be-a6d8-4526-9a4e-2fc782028d26","resolution":{"observed_at":"2026-05-11T05:20:58.246993Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-02T16:34:05.343320Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.08881","last_updated":"2026-07-30T10:00:35Z","snapshot_observed_at":"2026-08-11T03:10:45.292504Z","submitted_at":"2026-04-10T02:42:52Z","title":"Targeted Interpretable Safety Neuron Enhancement for Multilingual Vision-Language Large Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T16:34:05.343320Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2604.08881"},"observation_digest":"sha256:09a98b82bee438a3ca08722f7e486c3127aeb26a9e0399f25fa9e90b44d13afd","observation_id":"5e4b0086-e642-4c06-9d0b-98d122104444","resolution":{"observed_at":"2026-08-02T16:34:05.343320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":"2405.20773","doi":"10.48550/arxiv.2405.20773","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language mod- els via role-playing image character","venue":"arXiv (Cornell University)","work_id":"cfff0289-3100-466e-9e4e-d6998de6b0b4","year":2022},"citing_paper":{"arxiv_id":"2605.09443","last_updated":"2026-05-10T09:40:43Z","snapshot_observed_at":"2026-08-10T22:19:16.890614Z","submitted_at":"2026-05-10T09:40:43Z","title":"Through the Lens of Character: Resolving Modality-Role Interference in Multimodal Role-Playing Agent","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-12T04:49:56.954433Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2605.09443"},"observation_digest":"sha256:c8ce8806ed00d0ed6ae64d3d48157aeed93cbc32054ca72202b2f9e0739a60f7","observation_id":"0ae55dc8-cbca-449b-a83a-7bd0208d6261","resolution":{"observed_at":"2026-05-12T05:51:27.691230Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":"2405.20773","doi":"10.48550/arxiv.2405.20773","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language mod- els via role-playing image character","venue":"arXiv (Cornell University)","work_id":"cfff0289-3100-466e-9e4e-d6998de6b0b4","year":2022},"citing_paper":{"arxiv_id":"2605.25194","last_updated":"2026-05-24T17:51:34Z","snapshot_observed_at":"2026-07-06T23:35:11.987278Z","submitted_at":"2026-05-24T17:51:34Z","title":"Localization then Neutralization: Gradient-guided Token Suppression against Visual Prompt Injection Attack","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T12:19:12.910048Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2605.25194"},"observation_digest":"sha256:546e163ce4dfad2bc08310d4caf81300acdcf3047ea2e47d414805b6556abd15","observation_id":"c8fc2ab4-fa70-42b6-b1e0-179ecf95f63e","resolution":{"observed_at":"2026-06-30T12:24:39.790379Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":"2405.20773","doi":"10.48550/arxiv.2405.20773","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language mod- els via role-playing image character","venue":"arXiv (Cornell University)","work_id":"cfff0289-3100-466e-9e4e-d6998de6b0b4","year":2022},"citing_paper":{"arxiv_id":"2606.07706","last_updated":"2026-06-05T10:10:53Z","snapshot_observed_at":"2026-08-08T03:05:31.159664Z","submitted_at":"2026-06-05T10:10:53Z","title":"MLingualFC: Evaluating Jailbreak Vulnerabilities in Multilingual Vision-Language Models","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-06-27T21:47:22.295896Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2606.07706"},"observation_digest":"sha256:b519a14ae8017b8018589817307b4aafd5decdc0f28c8460ec3c08a63e5d3b79","observation_id":"7a59e5e3-7b94-4e75-b435-471ac28639ca","resolution":{"observed_at":"2026-07-02T18:57:16.800737Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":"2405.20773","doi":"10.48550/arxiv.2405.20773","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual- roleplay: Universal jailbreak attack on multimodal large language mod- els via role-playing image character","venue":"arXiv (Cornell University)","work_id":"cfff0289-3100-466e-9e4e-d6998de6b0b4","year":2022},"citing_paper":{"arxiv_id":"2606.26566","last_updated":"2026-06-25T03:32:12Z","snapshot_observed_at":"2026-08-12T21:54:41.598451Z","submitted_at":"2026-06-25T03:32:12Z","title":"Adversarial Diffusion Across Modalities: A Fusion Survey of Attacks, Defenses, and Evaluation for Text, Vision, and Vision-Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-26T04:35:51.583460Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2606.26566"},"observation_digest":"sha256:cb8dcdcaf271ac89d621c8de8e36e9ba336b10f78f30114361fa29205599d297","observation_id":"883b4f59-0aa4-434a-8c3e-0dd1f017de4b","resolution":{"observed_at":"2026-06-26T04:38:59.119984Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-01T08:23:25.911168Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image character,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21151","last_updated":"2026-07-26T23:23:12Z","snapshot_observed_at":"2026-08-06T16:53:45.184525Z","submitted_at":"2026-07-23T10:35:38Z","title":"V-DEAL: Diagnosing Video Safety De-Calibration as an Understanding-Refusal Coupling Failure","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T08:23:25.911168Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2607.21151"},"observation_digest":"sha256:020863c133240d9362fa536331d0fab06d2ccfaf364ed66a4ff583fabd11b32a","observation_id":"8d8a2ab6-d404-41d3-971f-ace533de2ab2","resolution":{"observed_at":"2026-08-01T08:23:25.911168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-07-30T20:22:15.367808Z","title":"Maity, S.; and Saikia, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24859","last_updated":"2026-07-26T07:46:28Z","snapshot_observed_at":"2026-08-09T20:46:17.449338Z","submitted_at":"2026-07-26T07:46:28Z","title":"The Mirage of LLM Guardrails: A Case Study in AI-Assisted Medical Note Manipulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-30T20:22:15.367808Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2607.24859"},"observation_digest":"sha256:a124622822254ab458a7c1c6b00ec3967278fa15cc036659edf761d8ffd5aefb","observation_id":"7e46ab36-d070-4706-8c15-0307e586e9e0","resolution":{"observed_at":"2026-07-30T20:22:15.367808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-07-31T23:07:39.941483Z","title":"arXiv preprint arXiv:2405.20773 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27917","last_updated":"2026-07-30T09:30:03Z","snapshot_observed_at":"2026-08-10T00:35:44.804679Z","submitted_at":"2026-07-30T09:30:03Z","title":"One Anchor for All: Unified Multilingual and Multimodal Safety Alignment for LVLMs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-31T23:07:39.941483Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2607.27917"},"observation_digest":"sha256:75bc6a40406152f8cf0796b896df76f9441c6ecba8fa1eababaf35a5421c6fae","observation_id":"07a487c6-9b7a-4608-b51e-29d8e149ba68","resolution":{"observed_at":"2026-07-31T23:07:39.941483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2405.20773/citation-record","integrity":"/paper/2405.20773/integrity","json":"/paper/2405.20773/citation-record.json","paper":"/paper/2405.20773"},"outbound":[],"paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","latest_version":2,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-12T23:58:03.234339Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 32 inbound Pith citation observations for arXiv:2405.20773."}