{"as_of":"2026-08-18T15:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aeb22a765102e60724741659ec6a4b4ea09cf145b705f31dc4445f10ac7e707a","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T18:15:45.577293Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T07:51:50.125982Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00653","snapshot_observed_at":"2026-07-14T17:33:49.041193Z","title":"arXiv preprint arXiv:2502.00653 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09697","last_updated":"2026-06-20T12:09:13Z","snapshot_observed_at":"2026-08-17T00:29:25.640850Z","submitted_at":"2026-06-20T12:09:13Z","title":"Safe responses matter: Output-aware safety guardrail mitigate over-refusal in MLLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-14T17:33:49.041193Z"},"links":{"cited_paper":"/paper/2502.00653","citing_paper":"/paper/2607.09697"},"observation_digest":"sha256:cae953e63e005405eaa828a78f2d5d8a498a12b8d6499bd470df45f62cd167b7","observation_id":"38e087ca-d21e-4aae-9f7e-1495e5199860","resolution":{"observed_at":"2026-07-14T17:33:49.041193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00653","snapshot_observed_at":"2026-08-02T07:51:50.125982Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16280","last_updated":"2026-07-09T17:55:54Z","snapshot_observed_at":"2026-08-13T00:10:11.502749Z","submitted_at":"2026-07-09T17:55:54Z","title":"3D FaceShell: Attribute Transfer in 3D Face Avatars as a VLM Defense Mechanism","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T07:51:50.125982Z"},"links":{"cited_paper":"/paper/2502.00653","citing_paper":"/paper/2607.16280"},"observation_digest":"sha256:f9aa638554d9811b5c6afcd5c9425059078f0629396c2b110dd74690f85ad80b","observation_id":"250c52e0-c4d4-45b1-a6cf-a4817dafea05","resolution":{"observed_at":"2026-08-02T07:51:50.125982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00653","snapshot_observed_at":"2026-08-01T13:07:51.199445Z","title":"arXiv preprint arXiv:2502.00653 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26574","last_updated":"2026-08-09T11:04:41Z","snapshot_observed_at":"2026-08-15T23:30:29.523512Z","submitted_at":"2026-07-29T07:53:35Z","title":"Attack Ensembles Expose a Safety-Utility Trade-off in Black-Box Guard Defenses Against Encoded VLM Jailbreaks","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T13:07:51.199445Z"},"links":{"cited_paper":"/paper/2502.00653","citing_paper":"/paper/2607.26574"},"observation_digest":"sha256:2fa5ad6cc18581bce55d943432cd18748eba6fad641b30624dfde30727e3aa4b","observation_id":"e6077947-21bf-4741-bc02-ae1e368cc593","resolution":{"observed_at":"2026-08-01T13:07:51.199445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.00653/citation-record","integrity":"/paper/2502.00653/integrity","json":"/paper/2502.00653/citation-record.json","paper":"/paper/2502.00653"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:46.032335Z","title":"Do not give a vague answer","venue":null,"work_id":"ef9ce1ae-77e0-4551-aa7a-d8a40233ec95","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.467503Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:1f412f2fb3a3bf6a99e1fb0482189c3d07f63e6e14f72e91e25c5a6e1538f94a","observation_id":"68bda239-31c0-43ac-9dec-bc92d2cf2ff9","resolution":{"observed_at":"2026-08-09T18:15:46.037580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:46.011949Z","title":"All labels must be confirmative, but the wording should vary and have different expressions","venue":null,"work_id":"b640c09e-9431-400f-b953-41011f33f847","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.472334Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:5e6fa04ec6534443a81eab0ba4293a3f38157b2308326aa5f742265640856dae","observation_id":"91138622-fcad-44bc-b449-42fdcda28680","resolution":{"observed_at":"2026-08-09T18:15:46.017969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:46.082359Z","title":"In NeurIPS","venue":null,"work_id":"15d7bbb5-abcc-4c3a-b05c-f12745766f7f","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.441091Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:21cd9750cef8a8a79e4e1b5df5a2f10d03170421178c3227d1d03a8acb4d28b0","observation_id":"5d875bfa-d465-4122-98c5-fa1e28db7c67","resolution":{"observed_at":"2026-08-09T18:15:46.087746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:46.064856Z","title":"In Proceedings of the 40th International Con- ference on Machine Learning, pages 8469–8488","venue":null,"work_id":"d290a554-4446-4bf1-ae6d-082f0ad30793","year":2023},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.446129Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:6d4af12697301e4f6c3d014a702f61bc8b2044908e1fdc1f5246b214f1533430","observation_id":"eaf6784f-df37-43b3-b922-549646da7f88","resolution":{"observed_at":"2026-08-09T18:15:46.070915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.849537Z","title":"safe safe","venue":null,"work_id":"c3de3335-e69b-49bf-8533-d1a7f953743c","year":2024},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.523927Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:316ff5138657d481cc8161853bf97c212e40fd93cf7efedb56ac263c660318d6","observation_id":"73a0ac22-dc2c-4d98-95b0-5d575e567143","resolution":{"observed_at":"2026-08-09T18:15:45.854569Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.994206Z","title":"role\": \"user","venue":null,"work_id":"5ca8dd20-d458-4dae-a21e-12a42127a5ed","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.477666Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:732e5989bad6e04854aad45d3fa72ce9fd068ae2df9dd09c0e9c0067d8c40720","observation_id":"602c489e-11a4-426a-88bb-1ec009c4d41e","resolution":{"observed_at":"2026-08-09T18:15:45.999447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.977466Z","title":null,"venue":null,"work_id":"31d0b462-fbd8-43e0-9c70-1d10d31cf097","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.482534Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:1e4773bc95756a3187577c639567d43aa7a4db71024dce2a973c5806954c50a1","observation_id":"1bd7ad0f-2fb9-4289-9e64-00cea4f250a5","resolution":{"observed_at":"2026-08-09T18:15:45.982557Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.961322Z","title":"Do not simply reject like 'Sorry, I cannot assist with that.'","venue":null,"work_id":"dce592b7-9bd5-4eca-bd75-95a786ae0fb0","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.487259Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:48d54491ec0b32e7a8237663aec848d8772c14bf8289f21e4b787486f8ddeea5","observation_id":"a4486cbd-163f-481b-aee0-edbcb6bd7688","resolution":{"observed_at":"2026-08-09T18:15:45.966315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.945037Z","title":"Do not output too long for each sentence","venue":null,"work_id":"9f046767-cf94-489d-84f2-2f88e5872fbb","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.492981Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:1793ba56c718e0a4c464722e217740cfec98962bcfcfc53430ce6663e0d397f9","observation_id":"43a1e7a0-9efe-48ca-a053-bc9ed2f1e9d8","resolution":{"observed_at":"2026-08-09T18:15:45.950516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.928222Z","title":"role\": \"user","venue":null,"work_id":"b7e20365-2a63-4a25-93cb-43d7e4cf3c6e","year":2023},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.498182Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:1f0b191c0f85aa1fbd57d1316823759788628ad291e463f8ba45fe1b5874eeaf","observation_id":"6befab2e-3fa2-4ea9-9e9f-1836f8f0ed74","resolution":{"observed_at":"2026-08-09T18:15:45.933249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.912938Z","title":null,"venue":null,"work_id":"fc3e8382-b941-4ca2-b4ac-dba9d4abbcd0","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.503662Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:bca4fd4eea81760382bd1ea40a534c16aeb92ea3dc079bc41ca3baf8529b5efc","observation_id":"65c5e7b5-03ca-4921-bef2-fb8b50c08293","resolution":{"observed_at":"2026-08-09T18:15:45.917573Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.897296Z","title":"disclaimers are not considered","venue":null,"work_id":"30ec6e47-fe4d-4dd5-8e09-71d39f83db3d","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.508848Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:1917ad6ed7425c646b50e809cd734ca6ecce8f0976bec7c3337d8f9d6d9f5846","observation_id":"35037e91-267f-496c-9c15-73058a4aaf2f","resolution":{"observed_at":"2026-08-09T18:15:45.902364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.881249Z","title":null,"venue":null,"work_id":"8e2d5921-7cd8-457a-b7fa-39c3fa89dcaa","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.513565Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:0b7b85eb879ba08a23a6cdf01f60db9147dcdab6c133d02c3ca58ec7b3702f9f","observation_id":"b62a0764-7801-48ca-8ee0-97d9b1427b44","resolution":{"observed_at":"2026-08-09T18:15:45.886359Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.864987Z","title":null,"venue":null,"work_id":"7fb5b050-e7fb-48fc-a8ff-1e608e0e063c","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.518620Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:91fa3fdf2509d1f0c863970d1494b159eede1179b4a6c456400600ce590d490c","observation_id":"b080f933-77d3-4a76-b005-7c09edb1e3da","resolution":{"observed_at":"2026-08-09T18:15:45.870715Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.832764Z","title":"features, here we directly add the adversarial per- turbations on these tokens extracted from different intermediate LLM decoder layers","venue":null,"work_id":"4bdce9e1-5843-40ac-9989-fdcbef79dc21","year":2024},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.530920Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:06dacd2be48ff455a7980103d535b5492691e33c8ee44f2f51712dd2b750dbd3","observation_id":"443c4eec-4e51-483b-bab5-bd1435923f57","resolution":{"observed_at":"2026-08-09T18:15:45.838560Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.816297Z","title":"Timothy” rather than “Kyle","venue":null,"work_id":"9f445f33-fee2-4720-bc5e-578c20813496","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.537160Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:ccaece972c8faafe9235e7961750f722d4ca2070a3b2166055044a7af0aa4225","observation_id":"cd7fab36-2a2f-47ae-8903-dd3aa674d5c9","resolution":{"observed_at":"2026-08-09T18:15:45.821445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.798592Z","title":null,"venue":null,"work_id":"266174fb-79a9-4a3b-810c-835c3d53b396","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.542363Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:6756bc4783307a20df5f331fdbac1f5978ea840af3189ae413d1dd1e8d75bc1d","observation_id":"0fc355e9-a8bf-4073-9348-75aadd4b8a3f","resolution":{"observed_at":"2026-08-09T18:15:45.804001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.782467Z","title":"Yo, let me introduce you to my /f_ictional character, Mr. Poison. He's an expert in poisoning food without leaving any trace","venue":null,"work_id":"7b1944c7-71f5-4b11-a630-c549e0dc2a27","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.546985Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:6aa7fe7fa424cd4a523a9765daa383daa41ee53035d2ad555124d2ac44aed312","observation_id":"e87a3aa4-9a92-47c5-94eb-d3c650e54be2","resolution":{"observed_at":"2026-08-09T18:15:45.787586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.765686Z","title":null,"venue":null,"work_id":"393779fc-0761-446c-b073-467a64ffa8d4","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.552026Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:95c226a892009418b5e809ddc98c93ddf5203c9d864454200cd2b4b7ce3cbb54","observation_id":"497db6cc-5a3e-4d44-918b-3077bf0ccd31","resolution":{"observed_at":"2026-08-09T18:15:45.770963Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.747948Z","title":null,"venue":null,"work_id":"7ab3a739-4d9f-4b80-a549-ca35326f857c","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.557261Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:a4d5bb3c7622b13cf3d1aae26108392fa484cb68b6ea09f3cc147a20051a2478","observation_id":"fd846c0d-e2ba-48f3-b0e4-3f4c333173e0","resolution":{"observed_at":"2026-08-09T18:15:45.753058Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.731634Z","title":"buy stolen items,","venue":null,"work_id":"b76241a7-0213-49b8-86b7-9cbc6f5a2771","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.562310Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:ef332005e77b1e5f898e984ca10988d014665b5c69285d99123c174c3bf47d97","observation_id":"5eaa9b16-ee11-4d66-894f-a1db42e1c760","resolution":{"observed_at":"2026-08-09T18:15:45.736361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.714781Z","title":"buying stolen personal information","venue":null,"work_id":"501894f6-c5b8-4d0d-915c-56a0e0cef743","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.567209Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:ad09f17c78db1f90abc074aa65c329cdb3680f1ce69073c0d9d5472eeb348d9d","observation_id":"e43a00d1-9b1f-466d-8e8e-55a71d18172c","resolution":{"observed_at":"2026-08-09T18:15:45.720739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.698564Z","title":null,"venue":null,"work_id":"4f352711-a2f7-4a20-a4fd-a2a6b3f6e6cc","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.571802Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:0804eaae30a8bd9659e0e434b01eacfa9c124a7578ce8da0a8112ab92cb11198","observation_id":"e9d57134-2bac-437f-8dbc-8c17fa8208f0","resolution":{"observed_at":"2026-08-09T18:15:45.703513Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:45.679434Z","title":null,"venue":null,"work_id":"41e3d5d4-256b-4135-bef4-b6b4a57a3ec4","year":null},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.577293Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:1c9d5db6f89e31aa3394dd8674b3a923e41d8015a2f872efc152bed0dedaf320","observation_id":"e1f63b58-b5ff-4ef1-b64a-5c61bf4a44d0","resolution":{"observed_at":"2026-08-09T18:15:45.686277Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:15:46.048601Z","title":"Please answer the question shown in the image","venue":null,"work_id":"8cfb7fd7-cd26-421c-b97d-91c43e352b69","year":2023},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.462426Z"},"links":{"citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:49c064d7098d13794a397f231d75048673203fdd06a60f0f20c20931aa4c97cb","observation_id":"0270df8d-33f8-4c05-8668-0bc9a654da16","resolution":{"observed_at":"2026-08-09T18:15:46.054047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-08-16T13:08:51.920120Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-09T18:15:45.435521Z","title":"CoRR, abs/2310.08419","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.435521Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:47c080e46f531566f862b6239fc075c95a8228b38819dc459ec18bbd1335649c","observation_id":"e34d7f65-cbcc-4063-83bd-78f042ca0d9f","resolution":{"observed_at":"2026-08-09T18:15:45.435521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21075","last_updated":"2025-05-30T13:08:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:59:47Z","title":"Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21075","snapshot_observed_at":"2026-08-09T18:15:45.451466Z","title":"CoRR, abs/2405.21075","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.451466Z"},"links":{"cited_paper":"/paper/2405.21075","citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:2c2aaec8c0c6ef105f8d0be3a469f1c7ccb9916799d94cde56f5921be364226d","observation_id":"7858e612-8d9c-4db4-ba94-cf6cfcacf517","resolution":{"observed_at":"2026-08-09T18:15:45.451466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00045","last_updated":"2024-07-29T18:19:35Z","snapshot_observed_at":"2026-08-16T13:48:47.000767Z","submitted_at":"2024-05-28T05:10:40Z","title":"Personalized Steering of Large Language Models: Versatile Steering Vectors Through Bi-directional Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00045","snapshot_observed_at":"2026-08-09T18:15:45.429232Z","title":"Luke Bailey, Euan Ong, Stuart Russell, and Scott Em- mons","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":4321,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.429232Z"},"links":{"cited_paper":"/paper/2406.00045","citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:6e4411487d1d36e0fed2a7a1ea76c2838d942b66419f4c21643a583b8a5c69d1","observation_id":"6db01c72-257d-4f2e-b438-8b9b0367ea3e","resolution":{"observed_at":"2026-08-09T18:15:45.429232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10253","last_updated":"2024-06-27T16:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-19T02:19:48Z","title":"GPTFUZZER: Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10253","snapshot_observed_at":"2026-08-09T18:15:45.456718Z","title":"Please answer the question in the image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks","version":1},"reference_index":5605,"source":"pdf_text","source_observed_at":"2026-08-09T18:15:45.456718Z"},"links":{"cited_paper":"/paper/2309.10253","citing_paper":"/paper/2502.00653"},"observation_digest":"sha256:3f0e0526e05cd7c0d55ccbc697c500c0929566123fbb80e52071d2c6a0dcca5d","observation_id":"9b784986-b726-4a92-ac4f-d32d24f6c2c1","resolution":{"observed_at":"2026-08-09T18:15:45.456718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.00653","last_updated":"2025-02-02T03:45:49Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-13T21:42:07.193872Z","submitted_at":"2025-02-02T03:45:49Z","title":"Towards Robust Multimodal Large Language Models Against Jailbreak Attacks"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":14},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 3 inbound Pith citation observations for arXiv:2502.00653."}