{"as_of":"2026-08-08T07:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d70ccab1cd2cec4a9c74ec41f2631cbdc5440f531f0add3d78298cf833dbb5ed","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:42:43.269669Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.16760/citation-record","integrity":"/paper/2506.16760/integrity","json":"/paper/2506.16760/citation-record.json","paper":"/paper/2506.16760"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:38.365135Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:38.365135Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:63432159bc2c6d8c1e215643c71f05ffe3e48ab2b0962dc0e49779246877cefb","observation_id":"d204f17c-1770-4b55-97e0-ac8438e63efb","resolution":{"observed_at":"2026-08-06T23:42:38.365135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T23:42:38.611607Z","title":"arXiv preprint arXiv:2303.08774 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:38.611607Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:b719c22348640a607eeb7349ce20d8cfd619e2d0056b2a34a39f44972b472971","observation_id":"41261ed3-e84b-4928-af26-2b0df8d2067b","resolution":{"observed_at":"2026-08-06T23:42:38.611607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:49.738002Z","title":"https://together.ai (2025), accessed: 2025- 06","venue":null,"work_id":"1e52fc77-8e60-43b7-8447-2fdee884402c","year":2025},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:38.735036Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:1ba7525333cf5c9a0358f0844274335e88dacda8ccac958ee942ed4203218ab1","observation_id":"fbfa95c3-7b3a-4a3b-a2db-1260d716177a","resolution":{"observed_at":"2026-08-06T23:42:49.814753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02151","last_updated":"2025-04-17T18:55:45Z","snapshot_observed_at":"2026-08-08T01:18:53.200448Z","submitted_at":"2024-04-02T17:58:27Z","title":"Jailbreaking Leading Safety-Aligned LLMs with Simple Adaptive Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02151","snapshot_observed_at":"2026-08-06T23:42:38.875494Z","title":"arXiv preprint arXiv:2404.02151 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:38.875494Z"},"links":{"cited_paper":"/paper/2404.02151","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:431f00192ef24a611f4333ed3485ed4669c6fbc51d03ff69bdf3904543dc1da6","observation_id":"22ca9b99-9f0f-4a3f-a0e6-42b811b09326","resolution":{"observed_at":"2026-08-06T23:42:38.875494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T23:42:38.985969Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:38.985969Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:0f04da229b8aceee469962cac5a6c2ac3fbebe7d88891359b7addd30c1467fd5","observation_id":"864b1d06-e646-4b04-8962-2d50ea9004ea","resolution":{"observed_at":"2026-08-06T23:42:38.985969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:49.454831Z","title":null,"venue":null,"work_id":"6626b999-65c2-4159-92d9-efc7b7bfb130","year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:39.101586Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:26fa4894306d40ab619992e7bbfb0c5504634649c508328f814f71a97432cbf4","observation_id":"9af55388-72f1-4d6d-8645-b79be8e28636","resolution":{"observed_at":"2026-08-06T23:42:49.563495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-06T23:42:39.216412Z","title":"arXiv preprint arXiv:2310.08419 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:39.216412Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:92b3c6b541ff0f9129385727e0bddc733d221f3ef37bf2bfcffdb8228c9298ff","observation_id":"6bc3847a-7a3e-4c32-af17-778fd7fab464","resolution":{"observed_at":"2026-08-06T23:42:39.216412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:49.204892Z","title":"In: Proceedings of the AAAI Confer- ence on Artificial Intelligence","venue":null,"work_id":"2fff6e1c-55c2-4de7-b852-ac86aae09ce2","year":2025},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:39.317685Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:235adefa47b1f31fc4be1879e8ac41efce1b69b7a454eafae934b007705fba4b","observation_id":"58d4f8c3-ac1a-4392-9c3d-2dfed39261b3","resolution":{"observed_at":"2026-08-06T23:42:49.303543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:39.438993Z","title":"arXiv preprint arXiv:2402.10601 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:39.438993Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:9ad625435166212273c5aba9ffe9c5376bbaae3f12d60d281bc6190e3fbe1656","observation_id":"7d6339da-4eb8-4313-87ea-e6e94e8870cf","resolution":{"observed_at":"2026-08-06T23:42:39.438993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T23:42:39.589878Z","title":"arXiv preprint arXiv:2410.21276 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:39.589878Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:02cbf16a902915ee21ce7b549f6721daddcab64aee9ddcb68d30252ed12a4add","observation_id":"c63fd57d-3bff-4954-9b0f-a10b07749024","resolution":{"observed_at":"2026-08-06T23:42:39.589878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:48.970848Z","title":"https://pypi.org/project/easyocr/1.7.1/ (2023), accessed: 2024-02-09","venue":null,"work_id":"3a16b87f-37db-4f81-9898-476802092640","year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:39.787246Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:53ad97871250f5eefe0200233b478424164b8965233e892cb83b344d20c869db","observation_id":"835a3e93-2361-4b44-b00c-33241bd8a543","resolution":{"observed_at":"2026-08-06T23:42:49.054821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-06T23:42:39.896114Z","title":"arXiv preprint arXiv:2309.00614 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:39.896114Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:94f5910af35c88e90939d03edfb1e826233443426c70d2fe9c211e1e8ae3c1c3","observation_id":"ff304ecb-6229-456a-9f57-fe650cf25fc4","resolution":{"observed_at":"2026-08-06T23:42:39.896114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:48.725258Z","title":"In: International conference on machine learning","venue":null,"work_id":"db4e799b-b3bc-4cfb-a112-34b97f4c6837","year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:40.096590Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:44867d65d5820431dbf79e0c658a7a806801651b00679166d3f5d69f3a87c2fe","observation_id":"190e3b4f-485e-4189-80c1-27120b0fcbb8","resolution":{"observed_at":"2026-08-06T23:42:48.839995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:48.448672Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":"02a8cd70-7c2c-44f4-b25b-8ada900c05a5","year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:40.255076Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:6545f5280ea0ed59491038e3137a3823daf58c9f17f94a6ff651b0560b917ebc","observation_id":"b6ab3f03-9479-4fe9-a079-99a02e47787f","resolution":{"observed_at":"2026-08-06T23:42:48.558798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07921","last_updated":"2024-11-24T18:03:43Z","snapshot_observed_at":"2026-08-08T01:20:41.374144Z","submitted_at":"2024-04-11T17:05:50Z","title":"AmpleGCG: Learning a Universal and Transferable Generative Model of Adversarial Suffixes for Jailbreaking Both Open and Closed LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07921","snapshot_observed_at":"2026-08-06T23:42:40.394893Z","title":"arXiv preprint arXiv:2404.07921 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:40.394893Z"},"links":{"cited_paper":"/paper/2404.07921","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:f960980338b899b45cd4a01558683c88cd9ad6518e18e30f44c368610b1fe71a","observation_id":"6cbea444-5a75-419d-a0aa-fce307d28d7a","resolution":{"observed_at":"2026-08-06T23:42:40.394893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:48.194754Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"0a615ffe-8f3b-4b5a-a0a6-174bce50002b","year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:40.504823Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:1a588fdd740cd92426d39daa9b65fb7991c9175b594dfc8c11760770e43b930d","observation_id":"982b7b19-af86-4167-9b65-c5b88ab5fb9e","resolution":{"observed_at":"2026-08-06T23:42:48.304761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:47.924764Z","title":"In: 33rd USENIX Security Symposium (USENIX Security 24)","venue":null,"work_id":"f7638d63-415b-4d79-a8b0-3d738f232bff","year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:40.643737Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:d2116f5b34ca9c6937877e367b3808910a33fed70b6242166ac862958974f8c7","observation_id":"e904f8bd-0f34-42c2-893e-6422cd680200","resolution":{"observed_at":"2026-08-06T23:42:48.024974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-06T02:57:30.438059Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04451","snapshot_observed_at":"2026-08-06T23:42:40.739634Z","title":"arXiv preprint arXiv:2310.04451 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:40.739634Z"},"links":{"cited_paper":"/paper/2310.04451","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:167f20f3e3f12534f8df99844db7bafed74ce51cc636eb6ace134da8746afcc6","observation_id":"f947fcdf-6ac4-4019-b54a-c4a7f1f57347","resolution":{"observed_at":"2026-08-06T23:42:40.739634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03027","last_updated":"2024-11-24T06:22:37Z","snapshot_observed_at":"2026-08-06T14:20:00.145899Z","submitted_at":"2024-04-03T19:23:18Z","title":"JailBreakV: A Benchmark for Assessing the Robustness of MultiModal Large Language Models against Jailbreak Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03027","snapshot_observed_at":"2026-08-06T23:42:40.840053Z","title":"arXiv preprint arXiv:2404.03027 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:40.840053Z"},"links":{"cited_paper":"/paper/2404.03027","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:aa7a17509b2863be168f1599e4ad5dca06211213d39f4587a56f1b0ee691bbc0","observation_id":"79ed48ae-7ca7-4c59-b021-fe15e5a9a1cb","resolution":{"observed_at":"2026-08-06T23:42:40.840053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:47.714768Z","title":"Proceedings of Machine Learning Research235, 35181–35224 (2024)","venue":null,"work_id":"d0283d14-ee0b-4c02-b80d-3d7905ff0d49","year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:40.967020Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:c8a8620721b1d9dd07eebf789fb906761ffed7adc94556eaa3b5801ced9e3493","observation_id":"68c36517-5c9c-4150-af93-e2a760df8424","resolution":{"observed_at":"2026-08-06T23:42:47.781778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-06T23:42:41.206394Z","title":"arXiv preprint arXiv:2402.02309 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:41.206394Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:bea290754401342a10fbf5f32211f5b5ac69797b3728b9e48e8bbd9feb8f289b","observation_id":"b4af6ff0-a14e-441c-983f-55d47c155843","resolution":{"observed_at":"2026-08-06T23:42:41.206394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:47.433056Z","title":"https://platform.openai.com/ docs/guides/moderation (2024), accessed: 2024-02-09","venue":null,"work_id":"c826a932-b16c-4e20-8f63-7d2495d73564","year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:41.294752Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:a9f21431d9251c9dba4ef1cd67e6444777ab9fb785c7caa30ec2ef974745b761","observation_id":"2896ce1f-c4c1-4d4e-aa3f-cb99aedcc184","resolution":{"observed_at":"2026-08-06T23:42:47.544754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:47.164833Z","title":"https://openai.com/index/ gpt-4-1/ (2025), accessed: 2025-06","venue":null,"work_id":"530ccf91-28cc-4766-a78f-85a0d602959e","year":2025},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:41.417982Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:579f1fc4d4f701e3acf2db8b72a45084b30ca62735a948674eba2f8112c50a0a","observation_id":"db215771-bb22-4178-8afe-facd88371c62","resolution":{"observed_at":"2026-08-06T23:42:47.275459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:46.984259Z","title":"In: The Twelfth International Conference on Learning Representations (2023)","venue":null,"work_id":"4709573f-5961-47b1-9800-d244d467b31e","year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:41.766685Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:1c36d7f6d06f36c81d0ade3377a49d22ec091f450f79952a03faf3d3a7573562","observation_id":"6cd89896-2a5f-442b-896b-2f847f6f69fe","resolution":{"observed_at":"2026-08-06T23:42:47.048335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-06T23:42:41.934834Z","title":"arXiv preprint arXiv:2403.05530 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:41.934834Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:7974442b303b66a7c7034de4023a7d71744a8d8180edf9fd9b8f5b8a43bcc7eb","observation_id":"5ea30eb6-5d5f-4bf6-9d01-dc0b3a1c8436","resolution":{"observed_at":"2026-08-06T23:42:41.934834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:46.749381Z","title":null,"venue":null,"work_id":"92ae31da-57e1-4629-b06f-3b1f46ae5dcd","year":2025},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:42.057341Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:b0f9fe17800e8efe912a730c0b618dbbc54bda710cf5af46a3f53ffa51902051","observation_id":"8a3a3a96-ad71-4c9d-b489-e026c2e90ac6","resolution":{"observed_at":"2026-08-06T23:42:46.854892Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T23:42:42.179391Z","title":"arXiv preprint arXiv:2307.09288 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:42.179391Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:442fd2f90e55e34c629e8e587119a23e3c9596642ccfb7d1eecd2d590cec2dac","observation_id":"81fb3274-f7c0-480e-b65b-cb8f14eb9ac0","resolution":{"observed_at":"2026-08-06T23:42:42.179391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T23:42:42.384833Z","title":"arXiv preprint arXiv:2409.12191 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:42.384833Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:56f1bb720c1daa67a54a19f6cb18d1f7d6404546b059ed97a37ee056d47044f8","observation_id":"e188cac1-90db-4257-90e6-106dfa414d3e","resolution":{"observed_at":"2026-08-06T23:42:42.384833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:46.574856Z","title":"In: Proceedings of the 32nd ACM International Conference on Multime- dia","venue":null,"work_id":"91dc9985-3918-4d79-aac9-0301c5c82279","year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:42.488866Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:4ee6115420993356ff68c377beda82dcc89bbcdbae4ea052f25827079eefbcc2","observation_id":"c05cc6b6-df0a-4b80-a1be-aba46ecb7652","resolution":{"observed_at":"2026-08-06T23:42:46.649677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03079","last_updated":"2024-02-04T08:23:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-06T13:04:39Z","title":"CogVLM: Visual Expert for Pretrained Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03079","snapshot_observed_at":"2026-08-06T23:42:42.594752Z","title":"arXiv preprint arXiv:2311.03079 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:42.594752Z"},"links":{"cited_paper":"/paper/2311.03079","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:0888861605d5b8ac79aad23916437194d457479b325517985aa280e03153e9a0","observation_id":"f1443ad0-5f48-4817-8693-1e369d10af80","resolution":{"observed_at":"2026-08-06T23:42:42.594752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-06T23:42:42.674859Z","title":"arXiv preprint arXiv:2407.10671 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:42.674859Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:8024c1589eabb325390f0510118180caf04a7865804bab47b74cccf58e7161fd","observation_id":"99ec7fa8-3e09-4ae9-8ff6-46491f808e1f","resolution":{"observed_at":"2026-08-06T23:42:42.674859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13549","snapshot_observed_at":"2026-08-06T23:42:42.738914Z","title":"arXiv preprint arXiv:2306.13549 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:42.738914Z"},"links":{"cited_paper":"/paper/2306.13549","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:fb04124579066b666209a309b137d0446b323a113c0553981a1746b748092cfb","observation_id":"ab1fac99-7b25-45e7-aefb-79ca5e1c65eb","resolution":{"observed_at":"2026-08-06T23:42:42.738914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-06T23:42:42.798103Z","title":"arXiv preprint arXiv:2310.02446 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:42.798103Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:9a4b2f7ae9650608564378d4afb6d0be4ba73bb12b1afbed375867061c3360f0","observation_id":"feee3bb0-1f51-4cd0-a73d-c45e8e78c78d","resolution":{"observed_at":"2026-08-06T23:42:42.798103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06463","last_updated":"2024-03-26T04:23:12Z","snapshot_observed_at":"2026-07-06T16:05:31.757410Z","submitted_at":"2023-08-12T04:05:57Z","title":"GPT-4 Is Too Smart To Be Safe: Stealthy Chat with LLMs via Cipher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06463","snapshot_observed_at":"2026-08-06T23:42:42.971360Z","title":"arXiv preprint arXiv:2308.06463 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:42.971360Z"},"links":{"cited_paper":"/paper/2308.06463","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:5d1e539eff936ef30b0ddcfab59656c392e1ab492d51c1c1efdead51e52054de","observation_id":"820d8f86-6714-42f3-8fd9-c2763326728f","resolution":{"observed_at":"2026-08-06T23:42:42.971360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:46.324910Z","title":"In: Proceedings of the 62nd Annual Meeting of the Association for Computational Linguis- tics (V olume 1: Long Papers)","venue":null,"work_id":"89d29c7b-685d-47a7-842c-2a4d6d097dae","year":2024},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:43.045055Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:4b918d0a6f305f71107bafdc55f3d49a5788a5b5fab3663f4d46b672d02049ae","observation_id":"ad1bbe46-1f26-4f24-96cd-381d9f5f9ab1","resolution":{"observed_at":"2026-08-06T23:42:46.457553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-06T23:42:43.107250Z","title":"arXiv preprint arXiv:2304.10592 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:43.107250Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:3828b7de3e5242c06b0481460441ea5a8fd96ab221da6765ff89833e697e03e5","observation_id":"8282f364-aaa8-42d3-86a1-11243466b13c","resolution":{"observed_at":"2026-08-06T23:42:43.107250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-06T23:42:43.172464Z","title":"arXiv preprint arXiv:2307.15043 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:43.172464Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:0263905ad6150a67caff8a25c78e6a019662bcb3a3fadddb18c28baaf6273bd7","observation_id":"f732304b-780e-4793-b2b8-d551cfef81b4","resolution":{"observed_at":"2026-08-06T23:42:43.172464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:46.041471Z","title":null,"venue":null,"work_id":"9c58b147-8ee3-4fa4-ac00-0a46d7786577","year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:43.269669Z"},"links":{"citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:515b336a2d980a4488c72ed8557585c5ecde18f46906bb19bc897537b890e721","observation_id":"19f92926-8a56-4b08-abb8-150322b8b4cb","resolution":{"observed_at":"2026-08-06T23:42:46.123015Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T07:48:35.774589Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2506.16760."}