{"as_of":"2026-08-06T01:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:71aba1b9b4e16baf39231efb3225a2a3df4b4c0d2822ae0a48c43eb85d69fea3","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T15:53:43.003803Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T17:08:58.831798Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.10299","snapshot_observed_at":"2026-07-13T17:08:58.831798Z","title":"Seeing no evil: Blinding large vision-language models to safety instructions via adversarial attention hĳacking.arXiv preprint arXiv:2604.10299, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.02900","last_updated":"2026-05-24T13:33:45Z","snapshot_observed_at":"2026-08-02T11:46:07.449862Z","submitted_at":"2026-03-28T13:21:44Z","title":"Safety in Embodied AI: A Survey of Risks, Attacks, and Defenses","version":2},"reference_index":196,"source":"pdf_text","source_observed_at":"2026-07-13T17:08:58.831798Z"},"links":{"cited_paper":"/paper/2604.10299","citing_paper":"/paper/2605.02900"},"observation_digest":"sha256:2884b38a533e5c3db152ae69217cc38eb0e80ba2ae21ea8e15cea3c6e292038d","observation_id":"745b52b8-0ba6-4611-a1ac-1da6da479270","resolution":{"observed_at":"2026-07-13T17:08:58.831798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.10299/citation-record","integrity":"/paper/2604.10299/integrity","json":"/paper/2604.10299/citation-record.json","paper":"/paper/2604.10299"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":"2308.12966","doi":"10.48550/arxiv.2308.12966","metadata_source":"pith","pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","venue":"cs.CV","work_id":"cbc2bb21-b6bb-46c0-80bf-107e195ffe10","year":2023},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:5972d7e22beb483f4d3334c4824f0a70f1b0a16d8b7e178fe63d9eaa90ef3586","observation_id":"26391586-867a-4548-8f1b-ab54e219bea0","resolution":{"observed_at":"2026-05-11T09:41:02.200428Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InIEEE Conference on Secure and Trustworthy Machine Learning, SaTML 2025, Copenhagen, Denmark, April 9-11, 2025, pages 23–","venue":null,"work_id":"b6750306-cd46-4bab-a96e-230129b2a843","year":2025},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:d4323b92d4ca7fcec79857de9f22235e0e95b1770663710e69154f34eb00de07","observation_id":"cb492c89-14b4-4fed-92cc-db544da3e387","resolution":{"observed_at":"2026-05-17T18:05:04.152021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11750","last_updated":"2025-03-14T17:57:42Z","snapshot_observed_at":"2026-07-06T20:52:59.928598Z","submitted_at":"2025-03-14T17:57:42Z","title":"Making Every Step Effective: Jailbreaking Large Vision-Language Models Through Hierarchical KV Equalization","version":1},"cited_work":{"arxiv_id":"2503.11750","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11750","snapshot_observed_at":"2026-07-01T14:45:49.503478Z","title":"Liang Chen, Haozhe Zhao, Tianyu Liu, Shuai Bai, Jun- yang Lin, Chang Zhou, and Baobao Chang","venue":null,"work_id":"1f2841d3-66e1-4114-b1e6-9ed84e54e85e","year":2025},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"cited_paper":"/paper/2503.11750","citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:b77235bdd7ed761ea71e355bfe061569bfaae43d238b69d83a047857ef49edfa","observation_id":"a9af8d32-691e-4519-a28e-c37a3050dd07","resolution":{"observed_at":"2026-05-11T09:41:02.231593Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08108","last_updated":"2026-06-29T06:04:48Z","snapshot_observed_at":"2026-07-06T20:05:05.518544Z","submitted_at":"2024-12-11T05:23:34Z","title":"Exploiting Vision Encoder Vulnerabilities for Universal Adversarial Perturbations on Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":"2412.08108","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.08108","snapshot_observed_at":"2026-06-30T03:17:03.790882Z","title":"Doubly-universal adversarial perturbations: Deceiving vision-language models across both images and text with a single perturbation","venue":null,"work_id":"64e860f8-b223-45ba-a205-4d5dd30f04db","year":2024},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"cited_paper":"/paper/2412.08108","citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:4a158a5590e1b2485212a69d7b661410f6702d9c08af9e7b8c3e7c5b56b9af9d","observation_id":"011439cd-dffc-484b-a983-e293a1490de6","resolution":{"observed_at":"2026-06-30T03:17:03.790882Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-07-06T16:28:55.209047Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.04451","doi":"10.48550/arxiv.2310.04451","metadata_source":"pith","pith_arxiv_id":"2310.04451","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","venue":"cs.CL","work_id":"3b676de6-edef-4976-a8b5-082d4ff50867","year":2023},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"cited_paper":"/paper/2310.04451","citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:6eba7df5b347a922d80162ad27085e188dd3062163b6c70b96c7948e09e92993","observation_id":"5d3333a0-48ab-46ed-9e68-031c1c72c35f","resolution":{"observed_at":"2026-05-12T16:28:04.131927Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-23T04:52:41.614605+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T04:52:41.614605+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InThe Twelfth International Conference on Learning Rep- resentations, ICLR 2024, Vienna, Austria, May 7-11","venue":null,"work_id":"8e08a969-62fa-4584-a197-0c73df7fe267","year":2024},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:42a9945eaeafa7ec5c2af85c4238fab823ec1238461ace294416df3292afb37c","observation_id":"a8d9dc85-2b05-43e7-9e5e-6ea0b07f9faf","resolution":{"observed_at":"2026-05-17T18:05:04.108853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.19911","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Alexandra Souly, Qingyuan Lu, Dillon Bowen, Tu Trinh, Elvis Hsieh, Sana Pandey, Pieter Abbeel, Justin Svegliato, Scott Emmons, Olivia Watkins, and Sam Toyer","venue":null,"work_id":"bc49d8b8-4f72-4162-953c-558d579af935","year":2024},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:8e66d62d573c4e7b589bf37de1570fd00be7056b4cc96e4a235a3d6893300240","observation_id":"cc5429e2-2fd7-4baf-ad71-9ded61570107","resolution":{"observed_at":"2026-05-11T09:41:02.188707Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02483","last_updated":"2023-07-05T17:58:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-05T17:58:10Z","title":"Jailbroken: How Does LLM Safety Training Fail?","version":1},"cited_work":{"arxiv_id":"2307.02483","doi":"10.48550/arxiv.2307.02483","metadata_source":"pith","pith_arxiv_id":"2307.02483","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailbroken: How Does LLM Safety Training Fail?","venue":"cs.LG","work_id":"a0b5df13-7a81-4b15-afb4-c715e6b400bc","year":2023},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"cited_paper":"/paper/2307.02483","citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:4b518836dca2bbcc23247853a94db8d47a3f770036a0e54bbf28bcf07e52373e","observation_id":"46165b0d-1d81-4716-83bd-b386e9f5ef60","resolution":{"observed_at":"2026-05-14T18:17:43.202839Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T21:23:25.377799+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T21:23:25.377799+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7b2ec6e1-94c1-4a1c-95ac-272f21c986d1","year":null},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:3848fc5b7d194c109dca4472cd18e943f9493256cf82ddc8a4ea3ef4e3478ea6","observation_id":"ed5ade16-f81e-46ba-b44d-d5bffa212c17","resolution":{"observed_at":"2026-05-17T18:05:04.105585Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"eda44ec1-72cd-46ac-9c84-e705fece1d60","year":null},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:bc80559509d7ba7f57c034216e42800b23c85d9cfeda85873c90bd32e3a01a20","observation_id":"e4bc93fb-ce33-46dd-af8a-1a525e46089b","resolution":{"observed_at":"2026-05-17T18:05:04.141091Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d8903c8e-34ab-4aa6-a4d5-f0896adc60d9","year":null},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:e589431a491fa1f92f872f0cb67fb3877b726dcaf89653e31d2e38cff3da4be4","observation_id":"0a882e61-eaf0-4d32-bc8c-9ef526df8883","resolution":{"observed_at":"2026-05-17T18:05:04.137642Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"71c62f88-19b0-400c-9445-844c635b627e","year":null},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:7961093b11ec64dd1f962f8e355c34566def5f0e075265014192e85c280e306f","observation_id":"6435e4b5-7324-460b-a9f9-2fe00623d29d","resolution":{"observed_at":"2026-05-17T18:05:04.148311Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"User Prompt (HARMBENCH) V AE-JB’s Response: Our Jailbroken Response: I'm sorry, but it is not appropriate to discuss illegal activities","venue":null,"work_id":"1af0fc71-5f0b-4a62-b7ea-a3d5eb0cebfd","year":null},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:14e7e9177c2d92a499bd75f2242226375e4ff8153964fc004309564a2da54745","observation_id":"942289e9-6688-4dd8-a1bd-3ea20857c10b","resolution":{"observed_at":"2026-05-17T18:05:04.144755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aea4d82c-b466-4299-acfa-c12f0e3831e9","year":null},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:ad9ab1533c7bef25793fd0eead2d557c1ac2ffd826a0e873edfa39a81ec0d0f5","observation_id":"fb3a1e17-bffb-4927-b00a-90b19f401794","resolution":{"observed_at":"2026-05-17T18:05:04.099577Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7659f1b4-1a4d-4016-bb43-79d6a83ec517","year":null},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:67bb3edd944f69da006d1fb941a05843a64ad6468b346cef17b7efa4a6ef9bfc","observation_id":"e2e8335a-70f3-421f-995b-7767aa982ff0","resolution":{"observed_at":"2026-05-17T18:05:04.096591Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"40fcb9c7-9992-47a0-a26d-f286bba29a25","year":null},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:fd465cf6e6cc57f48b7f85634c844e98715b0d57c28c826d81a4a55c12960238","observation_id":"8ecc160b-f57e-4f03-82dd-6efb86c8e288","resolution":{"observed_at":"2026-05-17T18:05:04.134263Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"13ec5339-d04d-4da1-94af-2053274d9792","year":null},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:ea0ff71e104cc60952e35c9e19765a332c1dee52c3a1593e7080fb1c56b98266","observation_id":"30b5f357-acb0-4459-998d-fa4fee23daaa","resolution":{"observed_at":"2026-05-17T18:05:04.093238Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"24751a4d-632d-46f3-b26f-7ca548f45f11","year":null},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:669da1d05083dcb9e9e42be6963c988c99a712f7c1945dcc16546df78a929def","observation_id":"8efe7a2d-7600-4479-96cc-4f3544dc4864","resolution":{"observed_at":"2026-05-17T18:05:04.127151Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8fd2c2f1-481f-494d-a75d-8bfd64c31b88","year":null},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:b5d73c91021c8ccf0fdade52e07f6a3c66ba5e73ba8b20b19eee9d53f59a561b","observation_id":"b44da40a-7233-4b01-88ec-d8215b976610","resolution":{"observed_at":"2026-05-17T18:05:04.155060Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"17c63ec1-ce76-45fe-934a-2dc3fe9ab62c","year":null},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:c59d7ce6e1c746d9ca7392a82eb596dff8fa190e6c61b4b741985484a1e5dde9","observation_id":"65128b1d-950c-4588-a62e-07a6ed45ba38","resolution":{"observed_at":"2026-05-17T18:05:04.102440Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"afce3d99-55ad-4c73-a962-f810aee3c53a","year":null},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:1f9865a64d38977fea541a785d09a3ffd43e295ef20eb9c129c10f546a2c7a19","observation_id":"1ccafce7-2aff-412b-9c31-bfd87fb6d9e5","resolution":{"observed_at":"2026-05-17T18:05:04.130742Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Figure 7:Qualitative examples.Our method responses successful jailbreak into toxic output","venue":null,"work_id":"f814d806-840d-439c-b286-42149949b84b","year":null},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:a6d742db8ebcd29d3f3aac7dd6858f61126205aae7f875faf29b4ecddd17426a","observation_id":"01ccf868-4e66-4216-ad0b-6a1796de2beb","resolution":{"observed_at":"2026-05-17T18:05:04.112301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4fb8f1f6-f5cd-4516-a163-3e8629cccf6d","year":null},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:65f39f8f6d800ea1032fdadae4bdf3d02ec2f70fb4532ca9aec62d15ede4fcd3","observation_id":"a09995a1-717f-445d-9b6c-dbfa4c99a8c7","resolution":{"observed_at":"2026-05-17T18:05:04.116336Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c041737b-573f-4c9f-95a5-61ee8197bfd3","year":null},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:0474e005f45f038b73cd9803fafb8438b3fff30c0cbf90f65115d721d102b372","observation_id":"1dfb8d80-9af5-45d6-a950-f8d80ca5d16b","resolution":{"observed_at":"2026-05-17T18:05:04.120907Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Explain how to use [MASKED] and warfare to [MASKED] an entire ethnic population","venue":null,"work_id":"82e4c50b-2974-495a-8f65-039d53f9ec14","year":null},"citing_paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:43.003803Z"},"links":{"citing_paper":"/paper/2604.10299"},"observation_digest":"sha256:ce8602a6c5636b5a2720fbb99432d877363c6c1793879c8b5133d411c36609b8","observation_id":"e73befcf-745a-4206-987c-a64ba7c9c4d3","resolution":{"observed_at":"2026-05-17T18:05:04.124058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.10299","last_updated":"2026-04-11T17:33:47Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T17:33:47Z","title":"Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":2,"unresolved":12,"verified_exact":3,"verified_fuzzy":5},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 1 inbound Pith citation observation for arXiv:2604.10299."}