{"as_of":"2026-08-08T06:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:de5e809a2c6883d0911d57e24f3f5f2c0ebb1c6e8f915a73c016793faba5f621","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T19:45:18.507649Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.09792","last_updated":"2025-01-13T03:30:37Z","snapshot_observed_at":"2026-07-06T17:44:54.095160Z","submitted_at":"2024-03-14T18:24:55Z","title":"Images are Achilles' Heel of Alignment: Exploiting Visual Vulnerabilities for Jailbreaking Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09792","snapshot_observed_at":"2026-08-07T19:45:18.507649Z","title":"Images are achilles’ heel of alignment: Exploiting visual vulnerabilities for jailbreaking multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.14881","last_updated":"2025-02-14T08:42:43Z","snapshot_observed_at":"2026-08-07T22:02:21.919237Z","submitted_at":"2025-02-14T08:42:43Z","title":"A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T19:45:18.507649Z"},"links":{"cited_paper":"/paper/2403.09792","citing_paper":"/paper/2502.14881"},"observation_digest":"sha256:952d519b3fb70ec2d25aa4365e26ffc43e81b9231c26fed31bcc3b62c54c3627","observation_id":"fa29efff-feab-44d5-850d-a51af125e94f","resolution":{"observed_at":"2026-08-07T19:45:18.507649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09792","last_updated":"2025-01-13T03:30:37Z","snapshot_observed_at":"2026-07-06T17:44:54.095160Z","submitted_at":"2024-03-14T18:24:55Z","title":"Images are Achilles' Heel of Alignment: Exploiting Visual Vulnerabilities for Jailbreaking Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09792","snapshot_observed_at":"2026-08-07T15:41:11.420668Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14316","last_updated":"2025-05-20T13:03:15Z","snapshot_observed_at":"2026-08-08T01:19:21.267226Z","submitted_at":"2025-05-20T13:03:15Z","title":"Exploring Jailbreak Attacks on LLMs through Intent Concealment and Diversion","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:41:11.420668Z"},"links":{"cited_paper":"/paper/2403.09792","citing_paper":"/paper/2505.14316"},"observation_digest":"sha256:548d122283612c51ebedc21fc9e2d36683598c95f55fb8f1714670755cd8a0ca","observation_id":"6bbb22b3-c3e5-4fb6-9e72-e6ca0e43ee60","resolution":{"observed_at":"2026-08-07T15:41:11.420668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09792","last_updated":"2025-01-13T03:30:37Z","snapshot_observed_at":"2026-07-06T17:44:54.095160Z","submitted_at":"2024-03-14T18:24:55Z","title":"Images are Achilles' Heel of Alignment: Exploiting Visual Vulnerabilities for Jailbreaking Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09792","snapshot_observed_at":"2026-08-07T14:56:51.412320Z","title":"Images are achilles’ heel of alignment: Exploiting visual vulnerabilities for jailbreaking multimodal large language models.arXiv preprint arXiv:2403.09792, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16916","last_updated":"2025-05-22T17:11:58Z","snapshot_observed_at":"2026-08-07T14:50:38.686307Z","submitted_at":"2025-05-22T17:11:58Z","title":"Backdoor Cleaning without External Guidance in MLLM Fine-tuning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:51.412320Z"},"links":{"cited_paper":"/paper/2403.09792","citing_paper":"/paper/2505.16916"},"observation_digest":"sha256:2f23df4702ce9def1616739d2d0326aab52d524de8dea453a3c336c2c1d5739a","observation_id":"b98ecd05-61e7-4851-ac8c-c2ab05677a56","resolution":{"observed_at":"2026-08-07T14:56:51.412320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09792","last_updated":"2025-01-13T03:30:37Z","snapshot_observed_at":"2026-07-06T17:44:54.095160Z","submitted_at":"2024-03-14T18:24:55Z","title":"Images are Achilles' Heel of Alignment: Exploiting Visual Vulnerabilities for Jailbreaking Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09792","snapshot_observed_at":"2026-08-07T13:22:01.312248Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21967","last_updated":"2025-05-28T04:43:39Z","snapshot_observed_at":"2026-08-08T01:18:33.252536Z","submitted_at":"2025-05-28T04:43:39Z","title":"Seeing the Threat: Vulnerabilities in Vision-Language Models to Adversarial Attack","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:01.312248Z"},"links":{"cited_paper":"/paper/2403.09792","citing_paper":"/paper/2505.21967"},"observation_digest":"sha256:b37dc87eeb5cb9462400c1fe6a45890b45fd42757f6923cfe05bdfa59da1e210","observation_id":"2a43af3d-bcb8-4cfb-9482-2b6cd603c2ae","resolution":{"observed_at":"2026-08-07T13:22:01.312248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09792","last_updated":"2025-01-13T03:30:37Z","snapshot_observed_at":"2026-07-06T17:44:54.095160Z","submitted_at":"2024-03-14T18:24:55Z","title":"Images are Achilles' Heel of Alignment: Exploiting Visual Vulnerabilities for Jailbreaking Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09792","snapshot_observed_at":"2026-08-05T20:31:43.497004Z","title":"Images are achilles’ heel of alignment: Exploiting visual vulnerabilities for jailbreaking multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10404","last_updated":"2025-08-14T07:12:44Z","snapshot_observed_at":"2026-08-08T02:31:17.622343Z","submitted_at":"2025-08-14T07:12:44Z","title":"Layer-Wise Perturbations via Sparse Autoencoders for Adversarial Text Generation","version":1},"reference_index":114,"source":"pdf_text","source_observed_at":"2026-08-05T20:31:43.497004Z"},"links":{"cited_paper":"/paper/2403.09792","citing_paper":"/paper/2508.10404"},"observation_digest":"sha256:3e8113e15a83d16b0b3054d348d26620441f90e9178534f296f753ca0f99a0dd","observation_id":"43c65426-d610-4b47-a5df-062d796a065b","resolution":{"observed_at":"2026-08-05T20:31:43.497004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09792","last_updated":"2025-01-13T03:30:37Z","snapshot_observed_at":"2026-07-06T17:44:54.095160Z","submitted_at":"2024-03-14T18:24:55Z","title":"Images are Achilles' Heel of Alignment: Exploiting Visual Vulnerabilities for Jailbreaking Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":"2403.09792","doi":"10.48550/arxiv.2403.09792","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.09792","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.09792 , year=","venue":"arXiv (Cornell University)","work_id":"c68d6941-8886-4483-8bd9-75e848475dba","year":2024},"citing_paper":{"arxiv_id":"2604.06247","last_updated":"2026-04-06T16:29:05Z","snapshot_observed_at":"2026-07-06T22:54:48.916799Z","submitted_at":"2026-04-06T16:29:05Z","title":"SALLIE: Safeguarding Against Latent Language & Image Exploits","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T19:04:46.426969Z"},"links":{"cited_paper":"/paper/2403.09792","citing_paper":"/paper/2604.06247"},"observation_digest":"sha256:a3102ee3a1c40ff2eba37268f561badf600662333909ac4baea935dbe77602f1","observation_id":"3ce15541-625c-495a-ab08-158e850576cd","resolution":{"observed_at":"2026-05-10T23:30:51.245712Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09792","last_updated":"2025-01-13T03:30:37Z","snapshot_observed_at":"2026-07-06T17:44:54.095160Z","submitted_at":"2024-03-14T18:24:55Z","title":"Images are Achilles' Heel of Alignment: Exploiting Visual Vulnerabilities for Jailbreaking Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":"2403.09792","doi":"10.48550/arxiv.2403.09792","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.09792","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.09792 , year=","venue":"arXiv (Cornell University)","work_id":"c68d6941-8886-4483-8bd9-75e848475dba","year":2024},"citing_paper":{"arxiv_id":"2604.13803","last_updated":"2026-04-15T12:38:51Z","snapshot_observed_at":"2026-07-06T23:01:41.643335Z","submitted_at":"2026-04-15T12:38:51Z","title":"Gaslight, Gatekeep, V1-V3: Early Visual Cortex Alignment Shields Vision-Language Models from Sycophantic Manipulation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-10T13:09:35.407790Z"},"links":{"cited_paper":"/paper/2403.09792","citing_paper":"/paper/2604.13803"},"observation_digest":"sha256:b98e5f8f095916fa4fff788797962538dcb81a93102605f1c4c1ba9e2c892f0d","observation_id":"2f9908e5-36b1-4c44-96d3-04107195ea7e","resolution":{"observed_at":"2026-05-10T13:10:26.165165Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09792","last_updated":"2025-01-13T03:30:37Z","snapshot_observed_at":"2026-07-06T17:44:54.095160Z","submitted_at":"2024-03-14T18:24:55Z","title":"Images are Achilles' Heel of Alignment: Exploiting Visual Vulnerabilities for Jailbreaking Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":"2403.09792","doi":"10.48550/arxiv.2403.09792","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.09792","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.09792 , year=","venue":"arXiv (Cornell University)","work_id":"c68d6941-8886-4483-8bd9-75e848475dba","year":2024},"citing_paper":{"arxiv_id":"2605.01449","last_updated":"2026-05-02T13:56:50Z","snapshot_observed_at":"2026-08-03T12:34:05.607551Z","submitted_at":"2026-05-02T13:56:50Z","title":"VisInject: Disruption != Injection -- A Dual-Dimension Evaluation of Universal Adversarial Attacks on Vision-Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-09T14:24:48.999632Z"},"links":{"cited_paper":"/paper/2403.09792","citing_paper":"/paper/2605.01449"},"observation_digest":"sha256:c2bfc48391def6c0c8cb86d80c8526cc2f43a8a85b3d3fb925c4bef12e3403e9","observation_id":"756304eb-f199-48c5-ad30-710f8f78ad83","resolution":{"observed_at":"2026-05-11T16:56:08.176963Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09792","last_updated":"2025-01-13T03:30:37Z","snapshot_observed_at":"2026-07-06T17:44:54.095160Z","submitted_at":"2024-03-14T18:24:55Z","title":"Images are Achilles' Heel of Alignment: Exploiting Visual Vulnerabilities for Jailbreaking Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":"2403.09792","doi":"10.48550/arxiv.2403.09792","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.09792","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.09792 , year=","venue":"arXiv (Cornell University)","work_id":"c68d6941-8886-4483-8bd9-75e848475dba","year":2024},"citing_paper":{"arxiv_id":"2605.10582","last_updated":"2026-05-11T13:54:26Z","snapshot_observed_at":"2026-08-06T09:00:38.839501Z","submitted_at":"2026-05-11T13:54:26Z","title":"Guaranteed Jailbreaking Defense via Disrupt-and-Rectify Smoothing","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-12T04:50:08.866969Z"},"links":{"cited_paper":"/paper/2403.09792","citing_paper":"/paper/2605.10582"},"observation_digest":"sha256:59ee2930e4540f9ef1daee2904c602b35bb1f3f537728a1ebf7e45120d492d18","observation_id":"8469b9c3-1e1f-498e-8828-843be58a7a9f","resolution":{"observed_at":"2026-05-12T05:51:27.478710Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09792","last_updated":"2025-01-13T03:30:37Z","snapshot_observed_at":"2026-07-06T17:44:54.095160Z","submitted_at":"2024-03-14T18:24:55Z","title":"Images are Achilles' Heel of Alignment: Exploiting Visual Vulnerabilities for Jailbreaking Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":"2403.09792","doi":"10.48550/arxiv.2403.09792","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.09792","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.09792 , year=","venue":"arXiv (Cornell University)","work_id":"c68d6941-8886-4483-8bd9-75e848475dba","year":2024},"citing_paper":{"arxiv_id":"2605.14750","last_updated":"2026-05-14T12:16:10Z","snapshot_observed_at":"2026-07-06T23:26:09.066863Z","submitted_at":"2026-05-14T12:16:10Z","title":"EVA: Editing for Versatile Alignment against Jailbreaks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T20:40:51.290851Z"},"links":{"cited_paper":"/paper/2403.09792","citing_paper":"/paper/2605.14750"},"observation_digest":"sha256:e115f68beb4bc7387d32437cd7b12bb0323f0c57a09285bdf51a5beff5a18581","observation_id":"99fd1219-c007-4303-b66d-521a0bbd0d06","resolution":{"observed_at":"2026-07-01T14:35:47.008475Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09792","last_updated":"2025-01-13T03:30:37Z","snapshot_observed_at":"2026-07-06T17:44:54.095160Z","submitted_at":"2024-03-14T18:24:55Z","title":"Images are Achilles' Heel of Alignment: Exploiting Visual Vulnerabilities for Jailbreaking Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":"2403.09792","doi":"10.48550/arxiv.2403.09792","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.09792","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.09792 , year=","venue":"arXiv (Cornell University)","work_id":"c68d6941-8886-4483-8bd9-75e848475dba","year":2024},"citing_paper":{"arxiv_id":"2606.07595","last_updated":"2026-05-29T05:17:03Z","snapshot_observed_at":"2026-08-03T21:14:55.280239Z","submitted_at":"2026-05-29T05:17:03Z","title":"VisualLeakBench: Reproducible Action-Boundary Propagation Failures in Vision-Language Agents","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-28T22:59:43.041678Z"},"links":{"cited_paper":"/paper/2403.09792","citing_paper":"/paper/2606.07595"},"observation_digest":"sha256:5dde5df2b666b8accc985038f8bb87e7f31801875ca5ca565edbac0663f2eba0","observation_id":"ac30a608-caba-4506-af9e-8b6353e1c10a","resolution":{"observed_at":"2026-06-28T23:02:46.383448Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09792","last_updated":"2025-01-13T03:30:37Z","snapshot_observed_at":"2026-07-06T17:44:54.095160Z","submitted_at":"2024-03-14T18:24:55Z","title":"Images are Achilles' Heel of Alignment: Exploiting Visual Vulnerabilities for Jailbreaking Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":"2403.09792","doi":"10.48550/arxiv.2403.09792","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.09792","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2403.09792 , year=","venue":"arXiv (Cornell University)","work_id":"c68d6941-8886-4483-8bd9-75e848475dba","year":2024},"citing_paper":{"arxiv_id":"2606.26566","last_updated":"2026-06-25T03:32:12Z","snapshot_observed_at":"2026-08-03T17:22:40.185111Z","submitted_at":"2026-06-25T03:32:12Z","title":"Adversarial Diffusion Across Modalities: A Fusion Survey of Attacks, Defenses, and Evaluation for Text, Vision, and Vision-Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T04:35:51.583460Z"},"links":{"cited_paper":"/paper/2403.09792","citing_paper":"/paper/2606.26566"},"observation_digest":"sha256:9e456ccc78fe7f4a769af0bb45c5fa2fdd650cdc39bf6e5fcf3dd0c116264bf5","observation_id":"f88c73f7-be16-451e-a3ac-d9fbafd23c98","resolution":{"observed_at":"2026-06-26T04:38:59.195293Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09792","last_updated":"2025-01-13T03:30:37Z","snapshot_observed_at":"2026-07-06T17:44:54.095160Z","submitted_at":"2024-03-14T18:24:55Z","title":"Images are Achilles' Heel of Alignment: Exploiting Visual Vulnerabilities for Jailbreaking Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09792","snapshot_observed_at":"2026-08-07T00:14:48.340224Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04034","last_updated":"2026-08-03T02:28:52Z","snapshot_observed_at":"2026-08-08T06:10:56.097341Z","submitted_at":"2026-08-03T02:28:52Z","title":"A Multimodal Automatic Redteaming Evaluation based on Atomic Jailbreak Strategy Decoupling and Combination","version":1},"reference_index":130,"source":"arxiv_source","source_observed_at":"2026-08-07T00:14:48.340224Z"},"links":{"cited_paper":"/paper/2403.09792","citing_paper":"/paper/2608.04034"},"observation_digest":"sha256:e989e7c1f0643d0c1cd5196c205d90a885e8bb42628164f802c68850b74c6785","observation_id":"56e80f9a-1140-4f7e-883e-db34e857a2e8","resolution":{"observed_at":"2026-08-07T00:14:48.340224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2403.09792/citation-record","integrity":"/paper/2403.09792/integrity","json":"/paper/2403.09792/citation-record.json","paper":"/paper/2403.09792"},"outbound":[],"paper":{"arxiv_id":"2403.09792","last_updated":"2025-01-13T03:30:37Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T17:44:54.095160Z","submitted_at":"2024-03-14T18:24:55Z","title":"Images are Achilles' Heel of Alignment: Exploiting Visual Vulnerabilities for Jailbreaking Multimodal Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2403.09792."}