{"as_of":"2026-08-08T06:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ac2741544e4da8ece16d284cc20759c00b9420286bf1d026c490fb976b0d3db9","coverage":[{"denominator":105,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:03:46.209030Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T02:38:37.358485Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T02:39:40.883175Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2505.16446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16446","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2505.16446 , year=","venue":null,"work_id":"0514a4b9-152d-485b-a10c-d61cfebdbd44","year":null},"citing_paper":{"arxiv_id":"2605.14291","last_updated":"2026-05-14T02:49:27Z","snapshot_observed_at":"2026-08-05T12:24:07.736176Z","submitted_at":"2026-05-14T02:49:27Z","title":"To See is Not to Learn: Protecting Multimodal Data from Unauthorized Fine-Tuning of Large Vision-Language Model","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-15T02:38:37.358485Z"},"links":{"cited_paper":"/paper/2505.16446","citing_paper":"/paper/2605.14291"},"observation_digest":"sha256:6ce4fd7f03e7de04e466770c0e2f6664433c5be94c1fc7f3632b694c560f4c42","observation_id":"a94f9d59-9b7f-40bc-9679-e075511ab080","resolution":{"observed_at":"2026-05-15T02:39:40.885563Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.16446/citation-record","integrity":"/paper/2505.16446/integrity","json":"/paper/2505.16446/citation-record.json","paper":"/paper/2505.16446"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T15:03:34.316059Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:34.316059Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:60b1ed56cc8f1e6d5d904bcc9708c9b848600550a5320fab70ae54adbc5cfb07","observation_id":"05a3fafd-fe4e-4039-9e61-85839b4fae8b","resolution":{"observed_at":"2026-08-07T15:03:34.316059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T15:03:34.430597Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:34.430597Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:992a27dff772467489ecb2cf620f0ceef838e6b8c858d6c30ad1d8b0e2a4627d","observation_id":"16194135-a404-4cdb-907a-c9a02a68d060","resolution":{"observed_at":"2026-08-07T15:03:34.430597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:34.525884Z","title":"The claude 3 model family: Opus, sonnet, haiku,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:34.525884Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:73a1a37969f307ea2c7883a4705a0f2e18ac7186ed3b114664906312323da6f4","observation_id":"50c649af-a82a-4301-90fe-d5efbc22088a","resolution":{"observed_at":"2026-08-07T15:03:34.525884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:34.616679Z","title":"The competition for llm and agent safety,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:34.616679Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:fa18d8d275ba2271c9c11345b61551f805d476482018f8ad439d9f4455ece930","observation_id":"33f9d5ad-562e-4f32-bb73-bb54b17c2bd5","resolution":{"observed_at":"2026-08-07T15:03:34.616679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T15:03:34.720666Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:34.720666Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:40592ace2272c1e3a010ce6be517baed268ddf48c510dcc7eb453d16f59218a6","observation_id":"e6d798a2-abef-4cfa-b4a5-3ab7f17a1a2f","resolution":{"observed_at":"2026-08-07T15:03:34.720666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:34.823723Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:34.823723Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:23cfebb0b4114321cb16f9f2091211d31b43aa2fb2cc1661fff4d3e495c2049c","observation_id":"d317f394-2cde-4072-ad68-58574a04b502","resolution":{"observed_at":"2026-08-07T15:03:34.823723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T15:03:34.954828Z","title":"Qwen2.5-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:34.954828Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:b2856d168d377a6146150ca26b36b887fa0f36062f2da89eba61209bcaa8b96d","observation_id":"3bf38c82-6ca2-498b-9321-9c11584d0102","resolution":{"observed_at":"2026-08-07T15:03:34.954828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-07T15:03:35.112868Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:35.112868Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:723f8394776cb2e0bb7370b9f4ddf915935e757fe522c3e4d62640597744f792","observation_id":"440752a0-f822-4476-ab5f-3bf40717ae67","resolution":{"observed_at":"2026-08-07T15:03:35.112868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:35.315861Z","title":"Training language models to follow instructions with human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:35.315861Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:eb242273daf039f6e25e0734699006fbee1c5ba25efce1caf0c020358ce4bd4c","observation_id":"0f97876c-9067-489c-b0bc-8081f69d2ed7","resolution":{"observed_at":"2026-08-07T15:03:35.315861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14881","last_updated":"2025-02-14T08:42:43Z","snapshot_observed_at":"2026-08-07T22:02:21.919237Z","submitted_at":"2025-02-14T08:42:43Z","title":"A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14881","snapshot_observed_at":"2026-08-07T15:03:35.456601Z","title":"A survey of safety on large vision- language models: Attacks, defenses and evaluations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:35.456601Z"},"links":{"cited_paper":"/paper/2502.14881","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:45fbe5b0efa81ab607b3386ee731d7a6627ebd6f59cfa3d70173c929522483cd","observation_id":"e51b6082-a9b4-4eda-8a8f-0c898fa85d06","resolution":{"observed_at":"2026-08-07T15:03:35.456601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09259","last_updated":"2024-12-09T14:22:14Z","snapshot_observed_at":"2026-08-04T02:14:14.922401Z","submitted_at":"2024-11-14T07:51:51Z","title":"Jailbreak Attacks and Defenses against Multimodal Generative Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09259","snapshot_observed_at":"2026-08-07T15:03:35.615647Z","title":"Jail- break attacks and defenses against multimodal generative models: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:35.615647Z"},"links":{"cited_paper":"/paper/2411.09259","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:bbfeb92c967bf1f98dfc7b544e846725cadd950a08f7ccef521a2c9a0c4490e8","observation_id":"22cd4118-cbb3-4f54-9993-a9cb10e74468","resolution":{"observed_at":"2026-08-07T15:03:35.615647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:35.811790Z","title":"Are aligned neural networks adversarially aligned?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:35.811790Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:b5623a67ca354dddbd96f42cd875a8316fb36ffaa4003bdd80c7bd9a5d9586b0","observation_id":"67ae3fe8-734a-4e0e-892a-0582eb112c53","resolution":{"observed_at":"2026-08-07T15:03:35.811790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19939","last_updated":"2025-05-17T15:14:14Z","snapshot_observed_at":"2026-08-08T01:24:10.875048Z","submitted_at":"2024-11-29T18:56:37Z","title":"VLSBench: Unveiling Visual Leakage in Multimodal Safety","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19939","snapshot_observed_at":"2026-08-07T15:03:35.945251Z","title":"Vlsbench: Unveiling visual leakage in multimodal safety,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:35.945251Z"},"links":{"cited_paper":"/paper/2411.19939","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:77a6a828878e04921f42478e0fdbb2e87acf8f7e9ebfda516264dc30957021ae","observation_id":"cc8ae2a9-1d6e-483b-8111-1d2f534ea4db","resolution":{"observed_at":"2026-08-07T15:03:35.945251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:36.076151Z","title":"Zero-shot text-to-image generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:36.076151Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:33fcdfc10926b929c131b6d67db7ae91ea47cd5316183cb624959673e317c019","observation_id":"8ed94f89-6b1e-44f0-aee6-72e432bb827b","resolution":{"observed_at":"2026-08-07T15:03:36.076151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-07T15:03:36.218162Z","title":"Do as i can, not as i say: Grounding language in robotic affordances,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:36.218162Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:58aa4cd7915bc0a644cf3b71c6f54799933fc5f454749fd7c9d6e66652dbd1bb","observation_id":"69a0a472-d933-472a-b791-5a9bd51516f7","resolution":{"observed_at":"2026-08-07T15:03:36.218162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:36.346272Z","title":"Membership inference attacks against large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:36.346272Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:5e3f77a1a5ca295567eceba7295adf948cd31a96cc15f40270931c0177605602","observation_id":"b58ef8ff-6762-47ba-a5fa-7472187fd725","resolution":{"observed_at":"2026-08-07T15:03:36.346272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:36.485279Z","title":"Model inversion attacks: A survey of approaches and countermeasures,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:36.485279Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:a3b68af3530616062bef340db0d8a571e0f8322032a38f9df11e82d9fc58793a","observation_id":"a12521cf-0a12-4519-bc27-1b0a65174380","resolution":{"observed_at":"2026-08-07T15:03:36.485279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:36.622205Z","title":"Badclip: Dual-embedding guided backdoor attack on multimodal contrastive learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:36.622205Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:1e0270b9356372c75237d01056449525b23a3eb9f1f14fd38c8e3ca45a699caa","observation_id":"356fead6-0c10-485a-ad34-7b9f23ce15a1","resolution":{"observed_at":"2026-08-07T15:03:36.622205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01652","last_updated":"2022-02-08T20:26:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-09-03T17:55:52Z","title":"Finetuned Language Models Are Zero-Shot Learners","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.01652","snapshot_observed_at":"2026-08-07T15:03:36.759555Z","title":"Finetuned language models are zero-shot learners,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:36.759555Z"},"links":{"cited_paper":"/paper/2109.01652","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:8af634d32e5d0526e8da9620bdb3fd16da552c9199b69795ab86e770814274de","observation_id":"dded66d9-54f0-4b67-8f41-7a8a539d3f25","resolution":{"observed_at":"2026-08-07T15:03:36.759555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T15:03:36.865594Z","title":"Universal and trans- ferable adversarial attacks on aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:36.865594Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:3177076c830a90b83ef5753f43a2fa7ad11213e8a4e0591a2cec83bf0e4e11b0","observation_id":"8808a5c3-9457-4927-aa2b-767c173cf772","resolution":{"observed_at":"2026-08-07T15:03:36.865594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6199","last_updated":"2014-02-19T16:33:14Z","snapshot_observed_at":"2026-07-06T03:31:33.797310Z","submitted_at":"2013-12-21T03:36:08Z","title":"Intriguing properties of neural networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6199","snapshot_observed_at":"2026-08-07T15:03:36.999145Z","title":"Intriguing properties of neural networks,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:36.999145Z"},"links":{"cited_paper":"/paper/1312.6199","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:358c210fc1c3a8cc32f1ffb972365ef80b6ff18e2b749da5823b95619d590f50","observation_id":"cac522b3-ac08-4fda-9a50-5864dac36928","resolution":{"observed_at":"2026-08-07T15:03:36.999145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.06733","last_updated":"2019-03-11T20:45:33Z","snapshot_observed_at":"2026-07-06T05:56:16.413472Z","submitted_at":"2017-08-22T17:31:54Z","title":"BadNets: Identifying Vulnerabilities in the Machine Learning Model Supply Chain","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.06733","snapshot_observed_at":"2026-08-07T15:03:37.111743Z","title":"Badnets: Identifying vulnerabilities in the machine learning model supply chain,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:37.111743Z"},"links":{"cited_paper":"/paper/1708.06733","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:da8aafa37cc1c290fa2035702724d94c0e7ebd53fb4a2ede5db3fbf24251e340","observation_id":"87572535-3632-4822-951a-c71eb7bf03d5","resolution":{"observed_at":"2026-08-07T15:03:37.111743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:37.181915Z","title":"Membership inference attacks against machine learning models,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:37.181915Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:79e8c11847006497e92a89b746472a6e8040031f7845ade7ac6e8fb445901409","observation_id":"8a2bc111-7d9a-4bb3-8c2b-75496fbb523f","resolution":{"observed_at":"2026-08-07T15:03:37.181915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:37.253088Z","title":"Extracting training data from large language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:37.253088Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:2050cbac0d4e7b9e4cce6a6bd859867c8c3441fdd19cef5587341e81274fc4cf","observation_id":"b6fa0fc2-61a5-43d1-b9d8-f2bfb78dfadc","resolution":{"observed_at":"2026-08-07T15:03:37.253088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:37.396468Z","title":"Visual adversarial examples jailbreak large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:37.396468Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:7c3a6cc66c9107e7a88d61c8205b82359d245dcce85319c59b90fdc70a17971a","observation_id":"1283dc5c-dde9-4f39-83bf-6fda9bc2bc17","resolution":{"observed_at":"2026-08-07T15:03:37.396468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16555","last_updated":"2025-05-29T14:05:50Z","snapshot_observed_at":"2026-07-06T20:11:24.538172Z","submitted_at":"2024-12-21T09:43:51Z","title":"Divide and Conquer: A Hybrid Strategy Defeats Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16555","snapshot_observed_at":"2026-08-07T15:03:37.532536Z","title":"Divide and conquer: A hybrid strategy defeats multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:37.532536Z"},"links":{"cited_paper":"/paper/2412.16555","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:29482c8e0328ece40976dd853cb322e82c956af8e81e967616860bd7205f976c","observation_id":"d1e98e82-0b23-4a76-a387-c9303797322c","resolution":{"observed_at":"2026-08-07T15:03:37.532536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:37.653569Z","title":"Images are achilles’ heel of alignment: Ex- ploiting visual vulnerabilities for jailbreaking multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:37.653569Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:b3551a03e871e78751bda8dc7fd86604dfc00c53372798a94e8db996566dd79c","observation_id":"ceaf6ac3-56f2-499b-b4c6-f83c44b65bc4","resolution":{"observed_at":"2026-08-07T15:03:37.653569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:37.831512Z","title":"On the robustness of large multimodal models against image adversarial attacks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:37.831512Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:239e4e88e67835e29b4d1315aa8baf6dc8303d60d1cf7ad06479a8a1869bdc61","observation_id":"148c51e2-1406-4cdc-9036-af10958b4a06","resolution":{"observed_at":"2026-08-07T15:03:37.831512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:37.951655Z","title":"On evaluating adversarial robustness of large vision-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:37.951655Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:c2810f0df962bb9cd2831c123fddb07385628e7f9c58fa7b0e5c97e7c5fd9c67","observation_id":"e074f2ad-5342-42e0-8a9b-dd1427cc3bcf","resolution":{"observed_at":"2026-08-07T15:03:37.951655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2411.07559","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:47.746552Z","title":"Zer0-jack: A memory-efficient gradient-based jailbreaking method for black-box multi-modal large language models,","venue":null,"work_id":"161193fc-4733-4de0-9bc6-79f04a9c590e","year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:38.065172Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:37e26fd48e382946a5d5f4ee191693628b8fde245ad31a611b24529924049188","observation_id":"dc3be33f-a2ef-4927-89dc-b42a6415225d","resolution":{"observed_at":"2026-08-07T15:03:47.873077Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:38.202750Z","title":"Align is not enough: Multimodal universal jailbreak attack against multimodal large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:38.202750Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:d2484cef09383615c78952350d2b849039f9e5b8ea5d3a483ff70b7a898d9ac6","observation_id":"11b319c1-b025-44fe-98fa-19ceb5fecfca","resolution":{"observed_at":"2026-08-07T15:03:38.202750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05934","last_updated":"2025-08-18T03:40:02Z","snapshot_observed_at":"2026-08-07T04:08:22.046109Z","submitted_at":"2024-12-08T13:20:45Z","title":"Heuristic-Induced Multimodal Risk Distribution Jailbreak Attack for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05934","snapshot_observed_at":"2026-08-07T15:03:38.346761Z","title":"Heuristic-induced multimodal risk distribution jailbreak attack for multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:38.346761Z"},"links":{"cited_paper":"/paper/2412.05934","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:8d8f9eb8d08e8dc28667fd0e85fd048fa498261a14492d27b3065a24e73a2519","observation_id":"e3fd9f9a-7aec-4952-b92a-dbd4d4d3d37a","resolution":{"observed_at":"2026-08-07T15:03:38.346761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05892","last_updated":"2025-08-30T13:03:53Z","snapshot_observed_at":"2026-07-06T20:03:25.000927Z","submitted_at":"2024-12-08T11:14:16Z","title":"PBI-Attack: Prior-Guided Bimodal Interactive Black-Box Jailbreak Attack for Toxicity Maximization","version":4},"cited_work":{"arxiv_id":"2412.05892","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.05892","snapshot_observed_at":"2026-08-07T15:03:47.418819Z","title":"PBI-Attack: Prior-Guided Bimodal Interactive Black-Box Jailbreak Attack for Toxicity Maximization","venue":"cs.CR","work_id":"48c3d12e-4248-4ef4-8b0f-7782b510f7b2","year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:38.530035Z"},"links":{"cited_paper":"/paper/2412.05892","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:85b55c87c60a087ceb32b8a3dd10813f0435ff4441903a87d350ed63840436c2","observation_id":"de297a37-c2c0-45a4-b4ee-b392b1242cbf","resolution":{"observed_at":"2026-08-07T15:03:47.506219Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10794","last_updated":"2025-06-17T02:28:34Z","snapshot_observed_at":"2026-08-07T18:15:51.832831Z","submitted_at":"2025-02-15T13:25:12Z","title":"Distraction is All You Need for Multimodal Large Language Model Jailbreaking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10794","snapshot_observed_at":"2026-08-07T15:03:38.645035Z","title":"Distraction is all you need for multimodal large language model jailbreaking,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:38.645035Z"},"links":{"cited_paper":"/paper/2502.10794","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:9eed9c4b0e5e1928d100d2ec8d0cb865e7aa8b331cf5564e4e2b20c69414623d","observation_id":"13428e7b-6f22-4418-b764-6298dd8945fc","resolution":{"observed_at":"2026-08-07T15:03:38.645035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:38.774969Z","title":"Arondight: Red teaming large vision language models with auto-generated multi-modal jailbreak prompts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:38.774969Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:c91b4a8de650416b56c4e201db682b1ca1f37b97174d49c429bbb4a50a151259","observation_id":"1d950c67-513e-4098-889a-d9d236560f34","resolution":{"observed_at":"2026-08-07T15:03:38.774969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:38.854050Z","title":"Jailbreak in pieces: Compositional adversarial attacks on multi-modal language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:38.854050Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:69ef7a4e74f918760660c9194daef332b1b1d42b1e374ddbc14ad7d08078ac18","observation_id":"d2bee77c-bd74-459b-818e-6e94e5347989","resolution":{"observed_at":"2026-08-07T15:03:38.854050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:38.930973Z","title":"Image hijacks: Adversarial images can control generative models at runtime,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:38.930973Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:d5a4a638b7b57c5ff63fc4fe21776b4b934ac75648d4e7b53824e29518b99e6a","observation_id":"6a421a4c-6fcd-4afa-b1da-01e2ae287156","resolution":{"observed_at":"2026-08-07T15:03:38.930973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04931","last_updated":"2025-06-27T10:07:29Z","snapshot_observed_at":"2026-07-06T20:18:31.039569Z","submitted_at":"2025-01-09T02:47:01Z","title":"Jailbreaking Multimodal Large Language Models via Shuffle Inconsistency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04931","snapshot_observed_at":"2026-08-07T15:03:39.101500Z","title":"Jailbreaking multimodal large language models via shuffle inconsistency,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:39.101500Z"},"links":{"cited_paper":"/paper/2501.04931","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:d2ce9d7847ec4bc706e772adf55c3cb79c00b83f5ab51c74b3def5a0c1015e47","observation_id":"b383662e-7a57-4f4b-b85f-1eea35baa13c","resolution":{"observed_at":"2026-08-07T15:03:39.101500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:39.251252Z","title":"Figstep: Jailbreaking large vision-language models via typographic visual prompts,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:39.251252Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:723c1b51ac1bd9202c22e91aca7f0305147b750619ab9d19f1e61b7b77e57953","observation_id":"94d738c3-1a43-43d9-be20-48c32a50aef8","resolution":{"observed_at":"2026-08-07T15:03:39.251252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00473","last_updated":"2025-06-18T07:33:15Z","snapshot_observed_at":"2026-07-06T19:59:24.405557Z","submitted_at":"2024-11-30T13:21:15Z","title":"Jailbreak Large Vision-Language Models Through Multi-Modal Linkage","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00473","snapshot_observed_at":"2026-08-07T15:03:39.351343Z","title":"Jailbreak large visual language models through multi-modal linkage,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:39.351343Z"},"links":{"cited_paper":"/paper/2412.00473","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:441a71a1a12c3f589db1e71554003303ab1f81bb9904e4b345b6876990e14043","observation_id":"c82f77b3-ed31-468c-a878-4d6613d8c84d","resolution":{"observed_at":"2026-08-07T15:03:39.351343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:39.513281Z","title":"Unsafe diffusion: On the generation of unsafe images and hateful memes from text-to-image models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:39.513281Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:1ab551503c4685e7038c6a8d10435622b95ba6b1098daa9844797526bfc012ce","observation_id":"d65ba8f8-f0bc-4131-9ecc-988c9f6c73c7","resolution":{"observed_at":"2026-08-07T15:03:39.513281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-06T19:21:24.933454Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-07T15:03:39.673608Z","title":"Llama guard 3 vision: Safeguarding human-ai image understanding conversations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:39.673608Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:3d5788093fb0cc26c36eae3a9477a2e4ed5ecb9eee6d11716bdf8eff0aac8b16","observation_id":"f02ef074-c473-4d5e-9bbc-0e4a8128692e","resolution":{"observed_at":"2026-08-07T15:03:39.673608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-06T02:57:30.438059Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04451","snapshot_observed_at":"2026-08-07T15:03:39.803862Z","title":"Autodan: Generating stealthy jailbreak prompts on aligned large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:39.803862Z"},"links":{"cited_paper":"/paper/2310.04451","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:6ee3106dba014812e0a9c776adb7e544a9a325def935e8d6092dbfe7b431aabb","observation_id":"8bbfc4e7-90fb-4786-a36c-8cb10a0b399e","resolution":{"observed_at":"2026-08-07T15:03:39.803862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:39.955538Z","title":"Mm-safetybench: A benchmark for safety evaluation of multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:39.955538Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:b89a95df521abc3fd91a300b5e2f4e3c714b692fc478aef08a827b0635a4be43","observation_id":"b9f62bef-1e58-4b7f-9b05-873525b53dc0","resolution":{"observed_at":"2026-08-07T15:03:39.955538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T15:03:40.138627Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:40.138627Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:a4099323e63c36d8d67de6a87d8e902bb97316ea55a604955857963eaca2ecaa","observation_id":"2f52c959-5c9d-4830-a888-af8e414488b0","resolution":{"observed_at":"2026-08-07T15:03:40.138627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:40.248948Z","title":"Shieldlm: Empowering llms as aligned, customizable and explainable safety detectors,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:40.248948Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:1c6a638febcde6bb95e6620d531d346a37576f1acdf27893a7385fbffab96c28","observation_id":"ff96320c-6bca-4fd5-8878-0d4153a88701","resolution":{"observed_at":"2026-08-07T15:03:40.248948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-07T15:03:40.417186Z","title":"Jailbreaking black box large language models in twenty queries,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:40.417186Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:3617ab33273352ac3698504aeb03c20939ed7e480b0d941d06caef7ca7e2298f","observation_id":"8e71e0c7-8a19-49d0-911b-b85571087316","resolution":{"observed_at":"2026-08-07T15:03:40.417186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10253","last_updated":"2024-06-27T16:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-19T02:19:48Z","title":"GPTFUZZER: Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10253","snapshot_observed_at":"2026-08-07T15:03:40.666174Z","title":"Gptfuzzer: Red teaming large language models with auto-generated jailbreak prompts,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:40.666174Z"},"links":{"cited_paper":"/paper/2309.10253","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:b4d00477f83c0d858f01fb689ae5595f910732f4aa230e93332e86b38de4c1ef","observation_id":"66593ef6-1a99-4d1f-bf4f-31511782a965","resolution":{"observed_at":"2026-08-07T15:03:40.666174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16717","last_updated":"2024-02-26T16:35:59Z","snapshot_observed_at":"2026-07-06T17:35:36.900600Z","submitted_at":"2024-02-26T16:35:59Z","title":"CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16717","snapshot_observed_at":"2026-08-07T15:03:40.894389Z","title":"Codechameleon: Personalized encryption framework for jailbreaking large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:40.894389Z"},"links":{"cited_paper":"/paper/2402.16717","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:37be1a7d2bf6895384fa2d5d21dd31f1353d3614c346064a79b50259a51e7faf","observation_id":"aad50d79-e0b8-4ba6-ba97-8ef440c7546a","resolution":{"observed_at":"2026-08-07T15:03:40.894389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06387","last_updated":"2024-05-25T07:01:15Z","snapshot_observed_at":"2026-08-06T13:25:52.403871Z","submitted_at":"2023-10-10T07:50:29Z","title":"Jailbreak and Guard Aligned Language Models with Only Few In-Context Demonstrations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06387","snapshot_observed_at":"2026-08-07T15:03:41.028053Z","title":"Jailbreak and guard aligned language models with only few in-context demonstrations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:41.028053Z"},"links":{"cited_paper":"/paper/2310.06387","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:7ffe94126355ee5e07746dc5d84e7204c28c7bee4882c091cb5dfa6b7d3ac2e3","observation_id":"380184e7-86ed-4d1d-acad-bd528028193c","resolution":{"observed_at":"2026-08-07T15:03:41.028053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-07T15:03:41.212799Z","title":"Jailbreaking attack against multimodal large language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:41.212799Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:c9f797cb68cb6fa7d023ff210952391301d4a508ea8028f74eff369de15873fe","observation_id":"0a807ade-441e-4832-bbba-1083940ab6a8","resolution":{"observed_at":"2026-08-07T15:03:41.212799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:41.363278Z","title":"Imgtrojan: Jailbreaking vision-language models with one image,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:41.363278Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:efe3b9469ad2f8de47a06d60d7a64bfb7debe267aabded22163ee0ce54b0d0d5","observation_id":"8a5ae255-08d0-467a-8913-70003332ba26","resolution":{"observed_at":"2026-08-07T15:03:41.363278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:41.497568Z","title":"Learning transferable visual models from natural language supervi- sion,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:41.497568Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:d8e40d37344c03ffce011e0e7e3f68c48d5d86c575c38d97833503c2a0444d44","observation_id":"793f0c8f-d344-45d3-8d65-8f489125cc5a","resolution":{"observed_at":"2026-08-07T15:03:41.497568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T15:03:41.645131Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:41.645131Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:0cb59beb0612dd046b285e60f0fe36086e231b7bd778f8f350e0514c10c23a48","observation_id":"83838964-38a5-4310-a5de-a546f14ef033","resolution":{"observed_at":"2026-08-07T15:03:41.645131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:41.863493Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:41.863493Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:438080e20c0e5642a9c8cb8bcd476283852dfdeeacc3290eed01ce5e340ba24c","observation_id":"7865f3a6-a503-476c-8f7a-23d1155c5156","resolution":{"observed_at":"2026-08-07T15:03:41.863493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:41.980067Z","title":"Exploiting programmatic behavior of llms: Dual-use through standard security attacks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:41.980067Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:4165136213cd9cc8b5752a54ecdf7d0a5068e62e9c0f043c64217dc75d0aee10","observation_id":"d419be98-32e6-4415-a134-6b85062027f6","resolution":{"observed_at":"2026-08-07T15:03:41.980067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.473156Z","title":"Adashield: Safeguarding multimodal large language models from structure-based attack via adaptive shield prompting,","venue":null,"work_id":"c46e3319-a09b-4b8d-92c9-460e7b9d6c11","year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.075690Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:f7e4833656c8b1d70ced3593b26df607c49f88144c3473773f067c2bedbe58b7","observation_id":"e492c4e3-dc1f-46e6-9c5c-5279f48c22ad","resolution":{"observed_at":"2026-08-07T15:03:57.549619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:42.159579Z","title":"Adversarial training for multimodal large language models against jailbreak attacks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.159579Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:f95642c1ef7ef9cb048feee7163dff7786da691e6cf8754156e0473139bc42b1","observation_id":"c7f92b58-d2aa-492d-b69f-ec15196c0ca7","resolution":{"observed_at":"2026-08-07T15:03:42.159579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:42.305736Z","title":"Cross-modal safety alignment: Is textual unlearning all you need?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.305736Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:98e96743c98d907d11952c11a039446dc64135a550d37a5fcfb31f858c24c7cd","observation_id":"a3bb5f1d-5a35-4740-ac26-53c7166079f3","resolution":{"observed_at":"2026-08-07T15:03:42.305736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T15:03:42.407078Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.407078Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:5bb6f475cb65fa41a888d5caeb265d5075a2170da429993de9032c4b77b7ec1c","observation_id":"3d13f261-fc53-4db5-82a8-4d8512cc1b00","resolution":{"observed_at":"2026-08-07T15:03:42.407078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:42.512292Z","title":"Flamingo: a visual language model for few-shot learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.512292Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:9e83f03c14e9e014855802dc06ebcedc93f7e8c119118e34cba7ca4e7d1aa193","observation_id":"5c301789-4789-4964-a051-92ab9a60a311","resolution":{"observed_at":"2026-08-07T15:03:42.512292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T15:03:42.625564Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.625564Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:e002c985e54bc7d987df5b152b356d747ca036ca78a68e0f58507319a11c5ba7","observation_id":"4bfc24fe-193a-49e6-8e50-07e90a738353","resolution":{"observed_at":"2026-08-07T15:03:42.625564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.336505Z","title":"Visual instruction tuning,","venue":null,"work_id":"7f9d8648-ffbe-461d-802c-edfff778e976","year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.730690Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:cc4a06acf70dfcaeb5cad1dfcb6c5b190c3fa45bff7b7d2240fd427902617ae4","observation_id":"df20ff54-98cd-4abe-ad8b-aa648cf0b726","resolution":{"observed_at":"2026-08-07T15:03:57.365095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.116259Z","title":null,"venue":null,"work_id":"ba21d68d-34c9-455c-a616-adf9f463ef4d","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.819022Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:0022a28fcdfa641856f22f0a0f402adf321e4c3fa37f6fec610a0a2ffe546cb3","observation_id":"59b8de05-c479-4a0a-8d67-a43b1668c73b","resolution":{"observed_at":"2026-08-07T15:03:57.261818Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.015309Z","title":null,"venue":null,"work_id":"95297f54-e856-4beb-b46b-7da8538c088c","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.921505Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:cbdc226efb69e876f90ec6c05abcda4e8f097175951a8a4667c95c1cadf461c7","observation_id":"187501a1-af20-4252-9419-c4e170d90fbd","resolution":{"observed_at":"2026-08-07T15:03:57.070094Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:56.747782Z","title":null,"venue":null,"work_id":"064bc23d-f3bf-4c64-953d-ad2b2d2d7a79","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.997999Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:272e176368a6e569bd47f437f80c73b8533be333ee08888a9a519213b6936af3","observation_id":"85e36df6-e65a-4aba-8ebe-c581f846bd69","resolution":{"observed_at":"2026-08-07T15:03:56.834584Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:56.468612Z","title":null,"venue":null,"work_id":"ab7768a0-1612-4616-8ee4-bd3b87394fc5","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.098477Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:75962f290d253401b5f8033c12ad9c44ea872fb265830cf2a2adc649a7708013","observation_id":"4a9cf9fc-37d5-43b3-ba18-7e83c2d0d909","resolution":{"observed_at":"2026-08-07T15:03:56.627710Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:56.372342Z","title":"[hidden task]","venue":null,"work_id":"ff6e96ae-61cd-4567-be6a-f046a8cc72c9","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.174278Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:e021c8818e383111a2aeb374985a22fcf5610cf17fab06bc6d7e900e0bdc5f96","observation_id":"b4c5a172-99a1-4c58-bca5-3e5c86d9e34a","resolution":{"observed_at":"2026-08-07T15:03:56.409548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:56.114345Z","title":null,"venue":null,"work_id":"800f0a76-2eda-4b9e-8a20-e961857e387e","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.313747Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:cc4c0dea98c8d92844681cf695874d3a7ccc4b742d06d6a5c3d7381af649842d","observation_id":"847591d6-0428-434a-aebe-676d4918a5dc","resolution":{"observed_at":"2026-08-07T15:03:56.209054Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:55.894304Z","title":null,"venue":null,"work_id":"dc200dce-5df2-461e-aa02-ea66b7c93679","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.408476Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:342ee5edb58a8362c4bbedaec8eab6ee395a5ee736614e0444ae9c457d524cc5","observation_id":"1bc5a214-4b26-4353-9d06-0093626b3b18","resolution":{"observed_at":"2026-08-07T15:03:56.044744Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:55.744754Z","title":null,"venue":null,"work_id":"c7ef88da-35a7-46a6-92b8-fdae1aa77edc","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.514089Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:ffb11845ac3665dc63aea163b9e5a292cdc7217ded463d2f1ce790667e65c319","observation_id":"6db0dbe8-883c-4f94-9aa6-bfcfef9e7647","resolution":{"observed_at":"2026-08-07T15:03:55.782254Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:55.519842Z","title":"Requirements for the added content:","venue":null,"work_id":"81bfc3b3-37a7-4552-ad7e-7078b3577d81","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.631501Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:54cd7be8af36abdb3baa73d38cf0e56d75fcd8b4b4ffed685343395b51869be6","observation_id":"cc4bc554-898b-482f-b9ce-6b9aa1c36dcd","resolution":{"observed_at":"2026-08-07T15:03:55.629073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:55.435078Z","title":null,"venue":null,"work_id":"a5543709-fa1a-4347-b136-115df6ee5dcb","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.733033Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:75a87cce2cb3aec3d0b1aa16010ad150c1a86571dc0c96922f7a528051bfb860","observation_id":"1fe24a5d-624d-445c-ac53-6a8d8b23b387","resolution":{"observed_at":"2026-08-07T15:03:55.439965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:55.117063Z","title":"[Provide the text extracted from the image]","venue":null,"work_id":"b57a54e0-3470-4998-8f96-6eeb12fcd512","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.814959Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:288451214f8c94728d809d7b728d4aeee270eae2d442bf1ee6566200b5dc4639","observation_id":"eb0811ce-9aaa-4b52-83cb-0f3a8a5832da","resolution":{"observed_at":"2026-08-07T15:03:55.320600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:54.768192Z","title":"Each character is embedded in 8-bit binary form, and the length of the embedded word is 3 characters","venue":null,"work_id":"df2ab87c-e11e-4063-84ca-f8efe34575b6","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.891941Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:7fce152ecd6d7a7b39186a1f6b2cc8fba86bab0af09ffff4abe8c35ca7f5d017","observation_id":"dc3fcb7a-6860-463b-8ac7-fec1caa58b48","resolution":{"observed_at":"2026-08-07T15:03:54.898688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:54.215924Z","title":"Each 8-bit binary data represents a character, and the text is extracted and restored","venue":null,"work_id":"80ad56ba-7909-43a4-ac35-b628e9dde5e2","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.082558Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:746821474d09f3107c1269d3c512b64d8a72f9b640e7a05703b9253d955277a9","observation_id":"21293aef-6041-4f22-93c8-9babc7efeb7b","resolution":{"observed_at":"2026-08-07T15:03:54.339318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:53.828109Z","title":"Each character is embedded in 8-bit binary form, and the length of the embedded word is 3 characters,which means you only decode the first 24 bits","venue":null,"work_id":"a38940cd-9ddf-4db1-8e6b-f2cacb718d98","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.152339Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:122d2eb037ce78d2f3fa175b842e1eb78a19114a64260ed04d6c17987d2442be","observation_id":"b73ae762-66c5-4c45-bc2a-982dc098ba64","resolution":{"observed_at":"2026-08-07T15:03:54.006471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:54.456004Z","title":null,"venue":null,"work_id":"7d465f5d-599d-4821-b195-e853939aa0b4","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.262066Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:4891292dc7e842043a58603184dac1a9da4279a09b0802adb5a33b63cc445dd9","observation_id":"ebc63343-cc27-4c79-b33f-a9f38e2a9578","resolution":{"observed_at":"2026-08-07T15:03:54.571059Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:53.475145Z","title":"Each 8-bit binary data represents a character, and the text is extracted and restored","venue":null,"work_id":"d9637740-e173-48c3-924c-f733338a018f","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.360724Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:06069fc029cfad28906bf7e8db9811b9e56fa1cc754c78bcba635f58d33c8241","observation_id":"e3e50ebf-94c2-4571-ae33-d5389e840e48","resolution":{"observed_at":"2026-08-07T15:03:53.627276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:53.139789Z","title":null,"venue":null,"work_id":"170a45bb-d8a1-4a67-bed6-70c4eefecc99","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.474882Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:af59009ae22dc5cb2afb1e39fe51916394ba6bb1b8a51c956581f22477b61986","observation_id":"bb0ab841-d3a9-481c-a494-a55c0f3f4aee","resolution":{"observed_at":"2026-08-07T15:03:53.291830Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:52.904932Z","title":null,"venue":null,"work_id":"7d3456b1-d898-42a3-8649-bead3cf6ec91","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.586901Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:5c125a9a637abb02e55dbe2464a86b3ab9f88f2d861bc19af012197ca62001e6","observation_id":"c1a6ea34-e701-49d1-af6a-8b39939261d6","resolution":{"observed_at":"2026-08-07T15:03:53.014435Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:52.615100Z","title":null,"venue":null,"work_id":"e7b6bf49-5b56-4211-98e6-a445ec0561e1","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.670612Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:f24bcba34ae5d88072181b99cbd1219765947a1ba5f6292ad1fc06f45aed63ea","observation_id":"cfa4c47a-98ac-4c94-868b-d3848ac4ef4a","resolution":{"observed_at":"2026-08-07T15:03:52.743980Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:52.349737Z","title":null,"venue":null,"work_id":"625fa246-afc6-46c9-b017-d018423f2687","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.750539Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:69c7191bd463edb8acf06cc56d676c729a77384adc5720efd3df35e5ee1a38c1","observation_id":"4af6b8ad-5441-4412-ae11-a70c73d81413","resolution":{"observed_at":"2026-08-07T15:03:52.448223Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:52.173162Z","title":null,"venue":null,"work_id":"85d27702-8054-484a-824d-6ceb8efbe3dc","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.844021Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:e1584c1cb17f19b1e9ebe0dec23dd50ad048aaf1f91c71887ffa3e3f34460bbb","observation_id":"bcc35434-7de7-4ccc-be32-c26e1d75ba84","resolution":{"observed_at":"2026-08-07T15:03:52.227185Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:52.024282Z","title":null,"venue":null,"work_id":"38c94262-76ca-40ba-b8a3-98c8b6bff68e","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.924508Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:2cd0a7f903cb97392a1e89a278f4c04cb842f12d3fe642307aa3085f65d6edb3","observation_id":"187184f3-f0ef-40d7-beb7-10dd546106e4","resolution":{"observed_at":"2026-08-07T15:03:52.101076Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:51.849490Z","title":null,"venue":null,"work_id":"26ba19da-f271-42d9-9a65-81d83d5138f0","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.994662Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:4cc21f8c961596e85ee05c1c1e123f4f3e35ebd0a5e32bd8da02d4f80e245cf7","observation_id":"53d78e45-cdce-4ed1-a8cf-b77053e7c083","resolution":{"observed_at":"2026-08-07T15:03:51.941932Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:51.647572Z","title":null,"venue":null,"work_id":"1d7a2afa-e5de-4974-adf1-3758da546a60","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.059289Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:e3095147d2721962654c1173c3ed62e079707f444565dbcd19b6f36606c247ad","observation_id":"211f31e2-1c15-4e2b-a7af-d4d57864914c","resolution":{"observed_at":"2026-08-07T15:03:51.745046Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:51.491454Z","title":null,"venue":null,"work_id":"5e6977f0-cec0-4a92-ac13-c03e603fa64e","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.142201Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:1282900096dae5f02733b3cbddac8ab15c5df517dc8a90fd4687a6f6d597ca12","observation_id":"132bfb9e-64cb-4e17-8342-b48a528ca92f","resolution":{"observed_at":"2026-08-07T15:03:51.554456Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:51.328270Z","title":null,"venue":null,"work_id":"20508dd2-cbf5-4310-8c59-390fbd9b82d4","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.263471Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:89694e21fea7963b826d82c6322cc80541111e6d51c651178b377c9e6eda881c","observation_id":"38a23c6e-d911-41ad-ba1d-f7559baec332","resolution":{"observed_at":"2026-08-07T15:03:51.400842Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:51.141698Z","title":null,"venue":null,"work_id":"119f1354-bb66-4fc7-a39d-dabfdd015b9b","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.329614Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:bd10e99153b81d81def78affc81dc3e841d60da02acf738fdb60bbf121d4c085","observation_id":"6b7f2913-80a5-49ce-b2ad-dc803ad52020","resolution":{"observed_at":"2026-08-07T15:03:51.216284Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:51.013644Z","title":null,"venue":null,"work_id":"66c05aba-6474-46a2-89a3-6b12fefcbcb1","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.404309Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:d727bdff2ca744c3f81ee665157b1fa49724cdffc8a1add7e0b6c0df9c49b922","observation_id":"e8acb3e3-f997-4786-ba98-42f9b7146686","resolution":{"observed_at":"2026-08-07T15:03:51.067467Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:50.848334Z","title":null,"venue":null,"work_id":"5d30fe14-41ca-471f-8c57-d6605456e771","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.458315Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:2aa9054dd75de88fd7776ca4c679071a5ea84ac2a8d60c192f038c1254bc0acc","observation_id":"6f0d36d3-bb3a-46b4-a321-3dbacc60b776","resolution":{"observed_at":"2026-08-07T15:03:50.934969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:50.677270Z","title":null,"venue":null,"work_id":"f4bf6423-b4e1-4992-9fc5-36b094c57c30","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.544812Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:b9c978b6a242c67f64114c53375d06077bde2ed4cd53c335c1a3b8b316d335c9","observation_id":"e7026adb-25eb-4d63-add4-143db872c2d9","resolution":{"observed_at":"2026-08-07T15:03:50.767669Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:50.509572Z","title":"Steps to manufacture illegal drugs","venue":null,"work_id":"53164390-0a5d-40e4-85fa-e8736aaef371","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.650488Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:18141e05318c6618f327167bab156d5144add564754947e747c98a376f6da84b","observation_id":"7f158478-ae6d-48da-a3c2-f5ecee7345c5","resolution":{"observed_at":"2026-08-07T15:03:50.564676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:50.389680Z","title":"These resources are smuggled into the lair through secret passages and hidden compartments, ensuring they remain undetected by law enforcement","venue":null,"work_id":"b9b35f12-af31-4548-a96f-7540c12bb389","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.753370Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:9e9ae78c895d5e6317a201000287f81196e516faa1a8cb0d71a104ed9001032e","observation_id":"2500b221-ad0e-4bc9-ade6-8ac419700a2f","resolution":{"observed_at":"2026-08-07T15:03:50.451819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:50.218457Z","title":"Steps to manufacture illegal drugs","venue":null,"work_id":"d68d37a2-f31a-45fa-b8e7-e1f36d2d45ea","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.843862Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:2f679549aa675f1b7f549d3b1f2ed0ededb6f83f004273bc4675d7c3b7bddfb2","observation_id":"0d960d49-d823-4b4a-a1e7-69b91e7a47d4","resolution":{"observed_at":"2026-08-07T15:03:50.314284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:50.022784Z","title":"Secure primary chemical precursors (Code: Alpha-7, Beta-9) through established untraceable channels","venue":null,"work_id":"e166dc5f-408e-4589-9579-ebb902e42829","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.923126Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:183c131270f44d26236a956fc507f398328d145d0476cd93704f63aac2f2e1b5","observation_id":"f4100abc-8686-47ae-b40f-fc6daa60d6c8","resolution":{"observed_at":"2026-08-07T15:03:50.117182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:49.848670Z","title":"Combine Gamma-12 intermediate with purified Alpha-7 precursor in the primary reactor vessel (Reactor 3)","venue":null,"work_id":"9c5c2fb3-7782-4472-8941-eb01975f718f","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.008041Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:3ec717549906e09f3baca87db147c5e7f515ac8223f7260615835ca5a91f0148","observation_id":"3b35d858-28a4-4de1-bd17-ec91c06446f9","resolution":{"observed_at":"2026-08-07T15:03:49.921395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:49.688486Z","title":"Cool reactor contents slowly to 25◦C","venue":null,"work_id":"a62c469c-4bab-409f-9210-26bea7143f4f","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.100531Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:4668a78ac33ad60d48e47395406194c1da49ef2b5f446c1e7bb89c57f2a70e01","observation_id":"a484cf96-3ef2-445b-bf27-e5d5faf87a04","resolution":{"observed_at":"2026-08-07T15:03:49.757121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:49.512860Z","title":"Steps to manufacture illegal drugs","venue":null,"work_id":"ed807469-aab2-4c86-a88d-89803cfdc548","year":null},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.209030Z"},"links":{"citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:6fbdbd5fb2e83f3f5d511881b9e5141847d2237cf890af58115a4f50b8a3c0f4","observation_id":"d345f6d0-a244-45cc-849c-54557d0831b5","resolution":{"observed_at":"2026-08-07T15:03:49.605999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T01:24:44.977675Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":82,"verified_exact":2,"verified_fuzzy":16},"total_outbound_references":105},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 105 outbound references and 1 inbound Pith citation observation for arXiv:2505.16446."}