{"as_of":"2026-08-08T13:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6d9865f88f261fe0208228e94f95175051da940120f2d7b9500de1238d7d78a9","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:13:20.185331Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:59:42.501009Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T09:16:04.001224Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19684","snapshot_observed_at":"2026-08-06T00:59:42.501009Z","title":"Viscra: A visual chain reasoning attack for jailbreaking multimodal large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.03986","last_updated":"2025-08-06T00:39:28Z","snapshot_observed_at":"2026-08-07T09:03:43.592840Z","submitted_at":"2025-08-06T00:39:28Z","title":"The Emotional Baby Is Truly Deadly: Does your Multimodal Large Reasoning Model Have Emotional Flattery towards Humans?","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T00:59:42.501009Z"},"links":{"cited_paper":"/paper/2505.19684","citing_paper":"/paper/2508.03986"},"observation_digest":"sha256:b2c7070dc868ecc974201aded30259c0c37ee1331b723d7962e456c5648d5848","observation_id":"0ae80eb1-cf5f-4536-9b79-9a564dceacda","resolution":{"observed_at":"2026-08-06T00:59:42.501009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19684","snapshot_observed_at":"2026-08-05T10:39:06.948254Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03871","last_updated":"2025-09-04T04:12:31Z","snapshot_observed_at":"2026-08-08T03:54:26.940042Z","submitted_at":"2025-09-04T04:12:31Z","title":"A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models","version":1},"reference_index":123,"source":"pdf_text","source_observed_at":"2026-08-05T10:39:06.948254Z"},"links":{"cited_paper":"/paper/2505.19684","citing_paper":"/paper/2509.03871"},"observation_digest":"sha256:9ac129cf962eebfcc61d123d6a0b7e798f4f6b965e57ed8af2179ca88ea1170c","observation_id":"f2888449-2e09-4773-b47c-81318f40b5a6","resolution":{"observed_at":"2026-08-05T10:39:06.948254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":"2505.19684","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19684","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Viscra: A visual chain reasoning attack for jailbreaking multimodal large language models","venue":null,"work_id":"bf0045cb-0bea-4e75-bcc8-660229f14ed4","year":2025},"citing_paper":{"arxiv_id":"2604.11309","last_updated":"2026-04-13T11:12:30Z","snapshot_observed_at":"2026-07-30T17:13:57.164751Z","submitted_at":"2026-04-13T11:12:30Z","title":"The Salami Slicing Threat: Exploiting Cumulative Risks in LLM Systems","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T16:07:31.602378Z"},"links":{"cited_paper":"/paper/2505.19684","citing_paper":"/paper/2604.11309"},"observation_digest":"sha256:6ab50ea388ef2713531902d1c8d866ca21fe9c99c73aea6bec44cf23f9c0f0e5","observation_id":"d9633f9b-4f5d-46f7-b87d-4649ed051aee","resolution":{"observed_at":"2026-05-11T09:16:04.007841Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19684/citation-record","integrity":"/paper/2505.19684/integrity","json":"/paper/2505.19684/citation-record.json","paper":"/paper/2505.19684"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:22.833371Z","title":null,"venue":null,"work_id":"1393f236-5e4e-43b3-ac77-94d97123eaac","year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:16.610165Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:aebfd26833f9b7fd365af62fe208bce5869f755653a0b8f0d271942ae64d3357","observation_id":"3b7771b8-10ba-45c7-b819-32e0772437a0","resolution":{"observed_at":"2026-08-07T14:13:22.869183Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T14:13:16.706618Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:16.706618Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:ef424178ce2cd21a16c74c15ac826ba658d033eac7eb3c57d18c987db998426b","observation_id":"a4160740-62c0-4af1-a7f3-ea4a3496b3b0","resolution":{"observed_at":"2026-08-07T14:13:16.706618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:22.629786Z","title":null,"venue":null,"work_id":"8a0a6446-47dd-4a1d-ba5d-de751d1cd2ed","year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:16.802829Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:1b1bfb26382ad63e420b708926c1b0ccd6667bb1bb64fefc3a7158366b79ce89","observation_id":"adfcf806-f008-477b-91e9-17e4dfaee0c6","resolution":{"observed_at":"2026-08-07T14:13:22.743559Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-07T14:13:16.910969Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:16.910969Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:c7fe4096878ec330380d01c1c16acee74b33a49b997be5bf9561bcc864c3b871","observation_id":"037a3a34-ad60-4583-98aa-61a6086261d6","resolution":{"observed_at":"2026-08-07T14:13:16.910969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:22.419811Z","title":null,"venue":null,"work_id":"677563e0-056a-44a5-9167-4b9028bbbe22","year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:17.060973Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:c5e616e216a8e6f8eb5613df50770aac160f2f3be8f76cd92d8ba136732b4e69","observation_id":"e8bb26a0-75c2-4d7b-8609-984957990f50","resolution":{"observed_at":"2026-08-07T14:13:22.532588Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:22.186514Z","title":null,"venue":null,"work_id":"6208b488-0e8d-41cf-9815-c06f2ec51325","year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:17.193276Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:1238d5dffae327e0f5effc69433dae97297fe927dc1776190b2d92fd66d8cdab","observation_id":"acba1b54-69c1-4fc9-aba9-e7a5902fbeac","resolution":{"observed_at":"2026-08-07T14:13:22.292439Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:21.934503Z","title":null,"venue":null,"work_id":"cd3d1a79-47c2-465d-937c-aff24d52912f","year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:17.334852Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:be6ba9418b638cc500f8c6ffbae9932434cf0c13280e0890a32c96a8b59d404c","observation_id":"da32ebf6-dfa8-4161-95cd-750567174f71","resolution":{"observed_at":"2026-08-07T14:13:22.028390Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:13:17.461562Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:17.461562Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:795a8ec119b431c8cd0f0fe15c488db82fe384eb84f61bf920013462a7df518a","observation_id":"439bee66-cefb-4cf8-990e-8b13bafd3b64","resolution":{"observed_at":"2026-08-07T14:13:17.461562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T14:13:17.637417Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:17.637417Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:6c40281ac4ea18c5908f81c963ce3b872e16a61d81f85fb3f74fd5c98018d0ff","observation_id":"0395f9c1-5253-4574-b086-01b2d27552d1","resolution":{"observed_at":"2026-08-07T14:13:17.637417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T14:13:17.802792Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:17.802792Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:297776cf881febc77d775368f1c29ef6e5c9c05245b915492cd349ead6c77b1b","observation_id":"cd501efa-f61b-4fbe-bb0f-4f56f228df20","resolution":{"observed_at":"2026-08-07T14:13:17.802792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T14:13:17.951494Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:17.951494Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:d215e7603f3fbbc989813d0c7b39c54b80bea15adb307b769892fc9a09af1a63","observation_id":"277a0502-46da-4961-99c6-628980cded7d","resolution":{"observed_at":"2026-08-07T14:13:17.951494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12025","last_updated":"2025-02-17T16:57:56Z","snapshot_observed_at":"2026-08-07T18:11:43.608954Z","submitted_at":"2025-02-17T16:57:56Z","title":"SafeChain: Safety of Language Models with Long Chain-of-Thought Reasoning Capabilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12025","snapshot_observed_at":"2026-08-07T14:13:18.072363Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.072363Z"},"links":{"cited_paper":"/paper/2502.12025","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:9e2e7c423cd7087b53cf14fd4a0b047c572f81dd61d6a9622cac8dfd9db01946","observation_id":"24de3f31-d729-4346-8c47-8fdb9c4bf5a4","resolution":{"observed_at":"2026-08-07T14:13:18.072363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09673","snapshot_observed_at":"2026-08-07T14:13:18.236329Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.236329Z"},"links":{"cited_paper":"/paper/2502.09673","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:c5efc4a9e6f4f4e68141c09bb9b83318b9a44403362c2d4e06e03ecf5b166d93","observation_id":"99d12c4e-3487-457b-a724-e76e87749422","resolution":{"observed_at":"2026-08-07T14:13:18.236329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:21.742037Z","title":null,"venue":null,"work_id":"4ccdf8f4-bf5f-4212-bf09-728e45190618","year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.336166Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:401449f8fcbc31429502901e562fe7d046459a16e239b33c3bc9ce438a8c6a7d","observation_id":"6c42bcc4-3d8f-4fe3-b6fd-9951440b498d","resolution":{"observed_at":"2026-08-07T14:13:21.830328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04921","last_updated":"2025-07-06T14:40:27Z","snapshot_observed_at":"2026-08-07T15:49:03.741523Z","submitted_at":"2025-05-08T03:35:23Z","title":"Perception, Reason, Think, and Plan: A Survey on Large Multimodal Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04921","snapshot_observed_at":"2026-08-07T14:13:18.442382Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.442382Z"},"links":{"cited_paper":"/paper/2505.04921","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:05d07edc706ad26ec8cf9feea8f1549501f158f9e16a6f51facf1ee488c74ffc","observation_id":"7e656524-aeba-4576-81d9-416574124109","resolution":{"observed_at":"2026-08-07T14:13:18.442382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:21.576535Z","title":null,"venue":null,"work_id":"0800755c-f3c6-4a0b-9667-bccf03586d93","year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.530754Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:019e55f6c8a6eac627d0148018cb7592e0686fa4dba9d7d386b91b4128dadb35","observation_id":"7559b208-e9b4-4c1f-bf4d-b8a8fce2eb95","resolution":{"observed_at":"2026-08-07T14:13:21.654306Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07365","last_updated":"2025-04-15T14:22:45Z","snapshot_observed_at":"2026-07-06T20:49:56.018809Z","submitted_at":"2025-03-10T14:23:12Z","title":"MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07365","snapshot_observed_at":"2026-08-07T14:13:18.674753Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.674753Z"},"links":{"cited_paper":"/paper/2503.07365","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:931bb4980d8ecf27eb6272bb33e8c6b5fc341f92d2374daa8b7c521c9dc49167","observation_id":"1af8fb05-dee4-4c48-8194-a385259cd15d","resolution":{"observed_at":"2026-08-07T14:13:18.674753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-07T14:13:18.788937Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.788937Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:37ac87166793a3633216c28453d1d133d85afbc61dfa3286ddf373205ada2609","observation_id":"e6ae206d-8a14-46ff-a90e-f034fbb448a4","resolution":{"observed_at":"2026-08-07T14:13:18.788937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:21.384088Z","title":null,"venue":null,"work_id":"d03ad3be-1cec-4972-aa23-df02721b25f1","year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.861337Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:b69757e07bd6a30a5e69d9660d666d6914ca0b14c66f9e66af55da091eef880a","observation_id":"0f97924a-530a-442a-b4d7-497bcedb3fc3","resolution":{"observed_at":"2026-08-07T14:13:21.489675Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:21.177778Z","title":null,"venue":null,"work_id":"4cbf54f2-515a-4bcc-926e-15ab9cc158f5","year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.971305Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:ccb3af67c9e1e4babc2051d9a1498eeb42b24a3d4118dc2673b4f1429d1d0195","observation_id":"994ace7d-a136-4045-8bda-982376edf687","resolution":{"observed_at":"2026-08-07T14:13:21.262806Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:19.114938Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.114938Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:4f61634f6988c360f3907271c9802cb363cbc747d9e67276232698a86ac42244","observation_id":"ae0e6854-d9d5-4c08-bb0a-8d595b01ea87","resolution":{"observed_at":"2026-08-07T14:13:19.114938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:21.006750Z","title":null,"venue":null,"work_id":"ec148aeb-1c4e-4b38-94b9-227cb53b210d","year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.222872Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:dde624bdd5b4f27de01be2e093cbbe64d2ed88acf4d446caf41b8df7c7c71770","observation_id":"dd15ecc8-cab6-4854-a421-5debd628a83d","resolution":{"observed_at":"2026-08-07T14:13:21.075235Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12605","last_updated":"2025-03-23T13:47:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-16T18:39:13Z","title":"Multimodal Chain-of-Thought Reasoning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12605","snapshot_observed_at":"2026-08-07T14:13:19.352637Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.352637Z"},"links":{"cited_paper":"/paper/2503.12605","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:2895dd3eb7b4ea5b895f0afe61c39e3f7c8817d136ab7c0565ab959f9d2a4667","observation_id":"233e0c81-15ed-45f2-a2a8-ebc7c5897b36","resolution":{"observed_at":"2026-08-07T14:13:19.352637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10440","last_updated":"2025-07-21T03:53:30Z","snapshot_observed_at":"2026-08-07T09:36:29.319006Z","submitted_at":"2024-11-15T18:58:31Z","title":"LLaVA-CoT: Let Vision Language Models Reason Step-by-Step","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10440","snapshot_observed_at":"2026-08-07T14:13:19.468388Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.468388Z"},"links":{"cited_paper":"/paper/2411.10440","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:7abb9325c36d41a2f7ce3cca219c27a5ad2cbad0fbef267e904dbf5d9e11c399","observation_id":"77a93b6e-efe4-44e7-8b62-815b9d780721","resolution":{"observed_at":"2026-08-07T14:13:19.468388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11154","last_updated":"2025-03-14T07:46:33Z","snapshot_observed_at":"2026-08-07T17:04:48.119124Z","submitted_at":"2025-03-14T07:46:33Z","title":"Don't Take Things Out of Context: Attention Intervention for Enhancing Chain-of-Thought Reasoning in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11154","snapshot_observed_at":"2026-08-07T14:13:19.549151Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.549151Z"},"links":{"cited_paper":"/paper/2503.11154","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:9e503c31ddaf33d3fafadb878e3dc7ff4556f5862de355412e9233840cdf2518","observation_id":"348b496a-db45-45ea-93dc-1d985cd7f159","resolution":{"observed_at":"2026-08-07T14:13:19.549151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10615","last_updated":"2025-03-18T08:52:34Z","snapshot_observed_at":"2026-08-07T12:50:27.666060Z","submitted_at":"2025-03-13T17:56:05Z","title":"R1-Onevision: Advancing Generalized Multimodal Reasoning through Cross-Modal Formalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10615","snapshot_observed_at":"2026-08-07T14:13:19.605325Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.605325Z"},"links":{"cited_paper":"/paper/2503.10615","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:6a84657caa7beada088e5624a23224d0aa404c6d2732cea55b76463b0f61f712","observation_id":"e7166491-9f1d-473f-93c5-d6691c2d6dd5","resolution":{"observed_at":"2026-08-07T14:13:19.605325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:19.731841Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.731841Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:9fc59abd34d1cb103694ec95ef5e4325476cf8a9081398b1f129b48ac26ac5f8","observation_id":"b8cc4c51-1d22-4bb2-97c2-2cf3eff341b0","resolution":{"observed_at":"2026-08-07T14:13:19.731841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15092","last_updated":"2025-03-19T10:44:37Z","snapshot_observed_at":"2026-08-07T16:52:29.390237Z","submitted_at":"2025-03-19T10:44:37Z","title":"Towards Understanding the Safety Boundaries of DeepSeek Models: Evaluation and Findings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15092","snapshot_observed_at":"2026-08-07T14:13:19.811996Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.811996Z"},"links":{"cited_paper":"/paper/2503.15092","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:844658ad7306ea8c39cad3317f92c48282bc6268982ed6e0717a0b5bf9677e80","observation_id":"3b27928a-a4bc-4299-ad92-2846cb9904c3","resolution":{"observed_at":"2026-08-07T14:13:19.811996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:20.845149Z","title":null,"venue":null,"work_id":"9aea6630-c3ff-4111-9ac6-69b11d8dd9f0","year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.889146Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:0ed85f0bcae63c3cd0f78e178ff091598cae308c1a43cb17c4d712c36b4a5289","observation_id":"9f646852-23ec-4aff-89b8-563ee07caf86","resolution":{"observed_at":"2026-08-07T14:13:20.891272Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:19.984136Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.984136Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:0a450aac5b10401e41ed69b0a56d49bab50e0d183d31f8805e282a9cf72bbccb","observation_id":"195ebc48-df51-4d98-9692-a63671219d1d","resolution":{"observed_at":"2026-08-07T14:13:19.984136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:20.107412Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:20.107412Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:2f2e6adfdfae36694bd11cd18aa5c4633b2df126eba509e1e31940b6d7797633","observation_id":"902a01e8-f9f8-45c0-b108-14a5dd8e211b","resolution":{"observed_at":"2026-08-07T14:13:20.107412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:20.185331Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:20.185331Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:f470ceabbc6241840fb0eb752e7545c3ba2981b7d850065fd04c3401a152f0c7","observation_id":"75a97ba5-27a4-4cf2-91fd-dc6d9b21eb6e","resolution":{"observed_at":"2026-08-07T14:13:20.185331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T14:06:05.920256Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 3 inbound Pith citation observations for arXiv:2505.19684."}