{"as_of":"2026-08-06T03:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:902f902b37eb973db47bf27629bcc9310e69e2310aabecc206c230eafe0a8a7d","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T23:16:37.340618Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2602.14399/citation-record","integrity":"/paper/2602.14399/integrity","json":"/paper/2602.14399/citation-record.json","paper":"/paper/2602.14399"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-02T23:16:36.436497Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14399","last_updated":"2026-05-28T04:31:34Z","snapshot_observed_at":"2026-08-02T23:16:31.816367Z","submitted_at":"2026-02-16T02:15:58Z","title":"Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T23:16:36.436497Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2602.14399"},"observation_digest":"sha256:4ba10131498b515e2805b63e6490a188186c740e6847b221c914b63d92647eb4","observation_id":"20378c2b-3c5c-417c-b4df-9566d29802f8","resolution":{"observed_at":"2026-08-02T23:16:36.436497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-02T23:16:36.606097Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14399","last_updated":"2026-05-28T04:31:34Z","snapshot_observed_at":"2026-08-02T23:16:31.816367Z","submitted_at":"2026-02-16T02:15:58Z","title":"Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T23:16:36.606097Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2602.14399"},"observation_digest":"sha256:74ffb6cdeb5f64e247e9c28b1b29f59562ccb1c6a8e60c6f2a71f06b0002af77","observation_id":"1489303b-961a-45fd-8017-10d7a885674f","resolution":{"observed_at":"2026-08-02T23:16:36.606097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03027","last_updated":"2024-11-24T06:22:37Z","snapshot_observed_at":"2026-07-06T17:55:21.083912Z","submitted_at":"2024-04-03T19:23:18Z","title":"JailBreakV: A Benchmark for Assessing the Robustness of MultiModal Large Language Models against Jailbreak Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03027","snapshot_observed_at":"2026-08-02T23:16:36.747125Z","title":"Jailbreakv: A benchmark for assessing the robustness of multimodal large language models against jailbreak attacks.arXiv preprint arXiv:2404.03027,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14399","last_updated":"2026-05-28T04:31:34Z","snapshot_observed_at":"2026-08-02T23:16:31.816367Z","submitted_at":"2026-02-16T02:15:58Z","title":"Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T23:16:36.747125Z"},"links":{"cited_paper":"/paper/2404.03027","citing_paper":"/paper/2602.14399"},"observation_digest":"sha256:e36141ab877129abbf30938eef95ee27b80ca48123f990eaac952e51598da506","observation_id":"d1f1aed4-9907-4f24-8ab2-abe3bd2cd33b","resolution":{"observed_at":"2026-08-02T23:16:36.747125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20773","last_updated":"2024-06-12T07:13:48Z","snapshot_observed_at":"2026-07-06T18:23:15.098065Z","submitted_at":"2024-05-25T17:17:18Z","title":"Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20773","snapshot_observed_at":"2026-08-02T23:16:36.824638Z","title":"Visual-roleplay: Universal jailbreak attack on multimodal large language models via role-playing image character.arXiv preprint arXiv:2405.20773,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14399","last_updated":"2026-05-28T04:31:34Z","snapshot_observed_at":"2026-08-02T23:16:31.816367Z","submitted_at":"2026-02-16T02:15:58Z","title":"Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T23:16:36.824638Z"},"links":{"cited_paper":"/paper/2405.20773","citing_paper":"/paper/2602.14399"},"observation_digest":"sha256:a3c3737ee81311def00bf3ff7dff492493fc5f4ce050d6de869a435641b06cba","observation_id":"f036b930-a299-47f6-ba77-7ab84fc7cea0","resolution":{"observed_at":"2026-08-02T23:16:36.824638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:16:36.896991Z","title":"Derail yourself: Multi-turn llm jailbreak attack through self-discovered clues.arXiv preprint arXiv:2410.10700,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14399","last_updated":"2026-05-28T04:31:34Z","snapshot_observed_at":"2026-08-02T23:16:31.816367Z","submitted_at":"2026-02-16T02:15:58Z","title":"Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T23:16:36.896991Z"},"links":{"citing_paper":"/paper/2602.14399"},"observation_digest":"sha256:081153d8f7aa411a2a18151e17c1f59bf789d57f2ab11e5187e5dbd17c85b508","observation_id":"76e9f21c-2f3f-442b-b656-4f3113d1b154","resolution":{"observed_at":"2026-08-02T23:16:36.896991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-02T11:57:18.735747Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-02T23:16:36.943702Z","title":"Llama 2: Open foundation and fine- tuned chat models.arXiv preprint arXiv:2307.09288,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14399","last_updated":"2026-05-28T04:31:34Z","snapshot_observed_at":"2026-08-02T23:16:31.816367Z","submitted_at":"2026-02-16T02:15:58Z","title":"Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T23:16:36.943702Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2602.14399"},"observation_digest":"sha256:75b326c7803706c0f812ff3ebe728dbf25b90be27fbb0035bcbaabe9e94381b0","observation_id":"dee546ed-d331-4466-84aa-ec765f8b2e60","resolution":{"observed_at":"2026-08-02T23:16:36.943702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00473","last_updated":"2025-06-18T07:33:15Z","snapshot_observed_at":"2026-07-06T19:59:24.405557Z","submitted_at":"2024-11-30T13:21:15Z","title":"Jailbreak Large Vision-Language Models Through Multi-Modal Linkage","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00473","snapshot_observed_at":"2026-08-02T23:16:37.009571Z","title":"White-box multimodal jailbreaks against large vision- language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14399","last_updated":"2026-05-28T04:31:34Z","snapshot_observed_at":"2026-08-02T23:16:31.816367Z","submitted_at":"2026-02-16T02:15:58Z","title":"Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T23:16:37.009571Z"},"links":{"cited_paper":"/paper/2412.00473","citing_paper":"/paper/2602.14399"},"observation_digest":"sha256:548b795f5e31031d280326bd55ea2a4881fb0ac889396ed9bcde1c878af2d9c3","observation_id":"0d0660a2-962e-478c-a423-46ea702f87df","resolution":{"observed_at":"2026-08-02T23:16:37.009571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05610","last_updated":"2024-05-09T08:15:21Z","snapshot_observed_at":"2026-07-06T18:11:57.100591Z","submitted_at":"2024-05-09T08:15:21Z","title":"Chain of Attack: a Semantic-Driven Contextual Multi-Turn attacker for LLM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05610","snapshot_observed_at":"2026-08-02T23:16:37.158808Z","title":"V ., Zhou, D., and Chen, X","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14399","last_updated":"2026-05-28T04:31:34Z","snapshot_observed_at":"2026-08-02T23:16:31.816367Z","submitted_at":"2026-02-16T02:15:58Z","title":"Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T23:16:37.158808Z"},"links":{"cited_paper":"/paper/2405.05610","citing_paper":"/paper/2602.14399"},"observation_digest":"sha256:81661c20be1cb648ebcfdb004eba28a06d1b8dd495f2f3527903d4a8c108e3a8","observation_id":"550e8a54-d8d3-419b-8b95-167d0591c72b","resolution":{"observed_at":"2026-08-02T23:16:37.158808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10619","last_updated":"2025-05-28T09:31:33Z","snapshot_observed_at":"2026-08-02T12:09:36.861596Z","submitted_at":"2025-03-13T17:57:32Z","title":"Tempest: Autonomous Multi-Turn Jailbreaking of Large Language Models with Tree Search","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10619","snapshot_observed_at":"2026-08-02T23:16:37.266923Z","title":"and Arel, R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14399","last_updated":"2026-05-28T04:31:34Z","snapshot_observed_at":"2026-08-02T23:16:31.816367Z","submitted_at":"2026-02-16T02:15:58Z","title":"Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T23:16:37.266923Z"},"links":{"cited_paper":"/paper/2503.10619","citing_paper":"/paper/2602.14399"},"observation_digest":"sha256:6b691fb4a7b83673fa4c0bab629b59f05ed05a44875b9bc24d79465183013b1f","observation_id":"00241a2f-ca3c-41a2-a0f1-76fda022f846","resolution":{"observed_at":"2026-08-02T23:16:37.266923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-02T23:16:37.340618Z","title":"Z., and Fredrikson, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14399","last_updated":"2026-05-28T04:31:34Z","snapshot_observed_at":"2026-08-02T23:16:31.816367Z","submitted_at":"2026-02-16T02:15:58Z","title":"Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T23:16:37.340618Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2602.14399"},"observation_digest":"sha256:4e488b19131a6a7717e527e966583072c771f2460e102eda3ca7834be6c890fc","observation_id":"b6813ecd-c270-4a6d-a572-ebd877f52cca","resolution":{"observed_at":"2026-08-02T23:16:37.340618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19820","last_updated":"2025-03-28T00:37:10Z","snapshot_observed_at":"2026-07-06T20:43:31.843946Z","submitted_at":"2025-02-27T06:49:16Z","title":"Foot-In-The-Door: A Multi-turn Jailbreak for LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19820","snapshot_observed_at":"2026-08-02T23:16:37.115496Z","title":"Foot-in-the- door: A multi-turn jailbreak for llms.arXiv preprint arXiv:2502.19820,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14399","last_updated":"2026-05-28T04:31:34Z","snapshot_observed_at":"2026-08-02T23:16:31.816367Z","submitted_at":"2026-02-16T02:15:58Z","title":"Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-02T23:16:37.115496Z"},"links":{"cited_paper":"/paper/2502.19820","citing_paper":"/paper/2602.14399"},"observation_digest":"sha256:40c15905f87959c0a758473e3d700ccef5ec08836c86731493eeafd9680a9f5a","observation_id":"94a700ff-3cf7-4084-a601-6bd5018fa98a","resolution":{"observed_at":"2026-08-02T23:16:37.115496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-02T23:16:36.495324Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14399","last_updated":"2026-05-28T04:31:34Z","snapshot_observed_at":"2026-08-02T23:16:31.816367Z","submitted_at":"2026-02-16T02:15:58Z","title":"Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T23:16:36.495324Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2602.14399"},"observation_digest":"sha256:df0087830227c415ab5ef50d5215bafc4cbbb7e2b9b62f71709288daf25cc82b","observation_id":"fa1b7de9-2322-463e-af2c-5dfe15647f9d","resolution":{"observed_at":"2026-08-02T23:16:36.495324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04673","last_updated":"2025-05-07T10:09:55Z","snapshot_observed_at":"2026-07-06T21:20:31.151203Z","submitted_at":"2025-05-07T10:09:55Z","title":"REVEAL: Multi-turn Evaluation of Image-Input Harms for Vision LLM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04673","snapshot_observed_at":"2026-08-02T23:16:36.682289Z","title":"and Deshpande, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14399","last_updated":"2026-05-28T04:31:34Z","snapshot_observed_at":"2026-08-02T23:16:31.816367Z","submitted_at":"2026-02-16T02:15:58Z","title":"Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T23:16:36.682289Z"},"links":{"cited_paper":"/paper/2505.04673","citing_paper":"/paper/2602.14399"},"observation_digest":"sha256:8359b2a95573434c26f6a34a356ec9760575e76a28014c8c66b08d5254e69901","observation_id":"1173e618-490e-49e9-90bd-8aa57e633551","resolution":{"observed_at":"2026-08-02T23:16:36.682289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-07-06T19:51:05.604758Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-02T23:16:36.535613Z","title":"D., Upasani, K., and Pa- supuleti, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14399","last_updated":"2026-05-28T04:31:34Z","snapshot_observed_at":"2026-08-02T23:16:31.816367Z","submitted_at":"2026-02-16T02:15:58Z","title":"Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T23:16:36.535613Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2602.14399"},"observation_digest":"sha256:ca37779a42fff446789e3b7e7e8bed83ea277b1f2f364e2389245da581e9be10","observation_id":"9b244e70-b932-4792-b083-a976e5b4c038","resolution":{"observed_at":"2026-08-02T23:16:36.535613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.14399","last_updated":"2026-05-28T04:31:34Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T23:16:31.816367Z","submitted_at":"2026-02-16T02:15:58Z","title":"Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2602.14399."}