{"as_of":"2026-08-18T23:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9b32a552555a0129caf7cdea22e88b644670aeb0635d57203b0fb5629c2c60a1","coverage":[{"denominator":82,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":82,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:29:59.372879Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T20:18:54.813869Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T20:19:00.210071Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":"2504.18053","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.18053","snapshot_observed_at":"2026-08-05T20:19:00.210071Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","venue":"cs.CL","work_id":"f589cfa6-09e0-4b9c-b494-8bb718be8269","year":2025},"citing_paper":{"arxiv_id":"2508.13186","last_updated":"2025-08-14T13:46:47Z","snapshot_observed_at":"2026-08-16T22:35:58.941011Z","submitted_at":"2025-08-14T13:46:47Z","title":"MM-BrowseComp: A Comprehensive Benchmark for Multimodal Browsing Agents","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T20:18:54.813869Z"},"links":{"cited_paper":"/paper/2504.18053","citing_paper":"/paper/2508.13186"},"observation_digest":"sha256:93abb140da437d95872352f4798ad201466979ef9227f62bfb8e6aefb3d39023","observation_id":"701e583d-73bb-48cf-91f2-fe35ab599e05","resolution":{"observed_at":"2026-08-05T20:19:00.281226Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18053","snapshot_observed_at":"2026-08-04T09:47:23.933962Z","title":"Kangaroo: Lossless self-speculative decoding for accelerating llms via double early exiting.Ad- vances in Neural Information Processing Systems, 37:11946–11965, 2024a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13698","last_updated":"2026-07-14T06:18:50Z","snapshot_observed_at":"2026-08-15T11:10:34.711507Z","submitted_at":"2025-10-15T15:57:17Z","title":"Attention Misses Visual Risk: Risk-Adaptive Steering for Multimodal Safety Alignment","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T09:47:23.933962Z"},"links":{"cited_paper":"/paper/2504.18053","citing_paper":"/paper/2510.13698"},"observation_digest":"sha256:645646a2570b00ec677d02e728abbb07a9ed2caae30ca820c4ad1f821189c6da","observation_id":"e41a74eb-bb88-48a3-a0e8-309109c9ae6d","resolution":{"observed_at":"2026-08-04T09:47:23.933962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.18053/citation-record","integrity":"/paper/2504.18053/integrity","json":"/paper/2504.18053/citation-record.json","paper":"/paper/2504.18053"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-16T10:29:58.971332Z","title":"Dai, Anja Hauth, Katie Millican, David Silver, Slav Petrov, Melvin Johnson, Ioannis Antonoglou, Julian Schrittwieser, Amelia Glaese, Jilin Chen, Emily Pitler, Timothy P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:58.971332Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:d77e120e9c8307844d2792a8b54fceffb06ac2af95052f1173c83d5112c8c8b4","observation_id":"e10a668f-ff63-47f7-ba33-17cc35019d98","resolution":{"observed_at":"2026-08-16T10:29:58.971332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-08-10T12:03:10.373653Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-16T10:29:58.977026Z","title":"Brown, Jack Clark, Sam McCandlish, Chris Olah, and Jared Kaplan","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:58.977026Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:7311b6e8c622f4ba57c65045f3acaff7b38bcbb8d9555ba46d7b9620a865e0be","observation_id":"920bde59-3b8c-4ef0-abcb-d00a8846cda6","resolution":{"observed_at":"2026-08-16T10:29:58.977026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14762","last_updated":"2024-11-05T16:40:21Z","snapshot_observed_at":"2026-08-16T14:16:09.123077Z","submitted_at":"2024-02-22T18:21:59Z","title":"MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14762","snapshot_observed_at":"2026-08-16T10:29:58.982687Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:58.982687Z"},"links":{"cited_paper":"/paper/2402.14762","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:00f37adc1be20de4d9b07db51c6c1ee95a07c6d0c3b7ef194014eaa6678d9e11","observation_id":"d2265866-541a-48bd-85de-94793a13743a","resolution":{"observed_at":"2026-08-16T10:29:58.982687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-16T10:29:58.987874Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:58.987874Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:bb5daf559cf88126268932aa6bd9af535e144d4bb3cb06b3d30a1924adfdfa37","observation_id":"f4c62138-73d6-4df0-a052-cdfc3f598138","resolution":{"observed_at":"2026-08-16T10:29:58.987874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-16T10:29:58.993072Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:58.993072Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:96749a56272be6e4b5d6b17745202adbbcbad98cd983eeb61331446c51b7a4b3","observation_id":"6453a9a0-6f92-4783-83e2-6679b4e1673b","resolution":{"observed_at":"2026-08-16T10:29:58.993072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:58.999131Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:58.999131Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:742f53bcbc32c987913c7c50e074a69d2799d28f9fda7295465db5d31ef72d1b","observation_id":"89008e3b-3ba3-444e-840c-ba318a3372ba","resolution":{"observed_at":"2026-08-16T10:29:58.999131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:59.004473Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.004473Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:ef8fbe907818d4c9dd5e67d1b758a80e58c50fc71f8d8f5950f341bff3ee16df","observation_id":"81888494-e5c1-45b1-ac99-8f792c28af5c","resolution":{"observed_at":"2026-08-16T10:29:59.004473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:59.009251Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.009251Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:7f67142e6a9404364c6b9b8748c704cd499ad6af10a318edf2c5a640bc7be8f4","observation_id":"7b3f03d4-9325-4e14-a3e5-866a670df179","resolution":{"observed_at":"2026-08-16T10:29:59.009251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10081","last_updated":"2024-03-19T17:51:45Z","snapshot_observed_at":"2026-08-16T14:42:35.827825Z","submitted_at":"2023-11-16T18:37:29Z","title":"DRESS: Instructing Large Vision-Language Models to Align and Interact with Humans via Natural Language Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10081","snapshot_observed_at":"2026-08-16T10:29:59.013789Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.013789Z"},"links":{"cited_paper":"/paper/2311.10081","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:2efad7a0deb2ab9ab37aadcbb97ad0cc1d4b61793e130005d6f582e920bf8705","observation_id":"b03ca546-c6e5-487e-8df9-f9d557dfe0ea","resolution":{"observed_at":"2026-08-16T10:29:59.013789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16821","last_updated":"2024-04-29T20:24:30Z","snapshot_observed_at":"2026-08-17T14:16:52.244007Z","submitted_at":"2024-04-25T17:59:19Z","title":"How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16821","snapshot_observed_at":"2026-08-16T10:29:59.018850Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.018850Z"},"links":{"cited_paper":"/paper/2404.16821","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:02351a85038494dcf37a92b1e07727b6d8ea444be8254fa0dca41d35fcc78e8b","observation_id":"2fa4920d-fa2b-4f04-913a-3930d14a598b","resolution":{"observed_at":"2026-08-16T10:29:59.018850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-16T10:29:59.023665Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.023665Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:0875e7d5269626983382d5fe7d02eb4a6f8987a97a973d9229885a3b171e05bb","observation_id":"321581cb-67b2-47ef-8cd4-a10e27f89f2d","resolution":{"observed_at":"2026-08-16T10:29:59.023665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.04072","last_updated":"2022-05-09T07:03:30Z","snapshot_observed_at":"2026-08-16T17:01:43.452235Z","submitted_at":"2022-05-09T07:03:30Z","title":"Beyond Bounding Box: Multimodal Knowledge Learning for Object Detection","version":1},"cited_work":{"arxiv_id":"2205.04072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2205.04072","snapshot_observed_at":"2026-08-16T10:30:00.323919Z","title":"Beyond Bounding Box: Multimodal Knowledge Learning for Object Detection","venue":"cs.CV","work_id":"b69fbc00-7c48-451e-b497-1879d7a4210c","year":2022},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.028602Z"},"links":{"cited_paper":"/paper/2205.04072","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:195d99da53ed18cfddc1dbc12f5913dc2c4aa9afd6a70cc1f4c499c0846c1f76","observation_id":"e642e2ec-2e7f-45d9-abb8-d06edb607040","resolution":{"observed_at":"2026-08-16T10:30:00.329619Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-16T10:29:59.033134Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.033134Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:caf6bc5984e50b574d6e76f079662c8d74d1a08a2cbbe0b1962bb74ae7611d76","observation_id":"ce2a40d0-0c34-462c-a33a-fc5b4b9bac9c","resolution":{"observed_at":"2026-08-16T10:29:59.033134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:30:00.898407Z","title":null,"venue":null,"work_id":"163e77f2-b412-4adb-b0f5-27311bbdf6e0","year":2019},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.038798Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:5181588579d6b3ae855eae89e8bcac7a8ed3951240b8c9afc4610d29adb7eb11","observation_id":"96e609c9-bff4-4bd4-8966-09c7f91e03bd","resolution":{"observed_at":"2026-08-16T10:30:00.903628Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05608","last_updated":"2025-01-19T16:23:38Z","snapshot_observed_at":"2026-08-18T12:18:02.474208Z","submitted_at":"2023-11-09T18:59:11Z","title":"FigStep: Jailbreaking Large Vision-Language Models via Typographic Visual Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05608","snapshot_observed_at":"2026-08-16T10:29:59.043297Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.043297Z"},"links":{"cited_paper":"/paper/2311.05608","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:094ec1fbe4e3885cbee083d8b30fc1e7b9e5274f8c5f2531851e5224d310de93","observation_id":"5ecdc404-efe4-4b23-ba54-eefb57098d32","resolution":{"observed_at":"2026-08-16T10:29:59.043297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09572","last_updated":"2024-10-15T04:55:36Z","snapshot_observed_at":"2026-08-18T06:51:54.914685Z","submitted_at":"2024-03-14T17:03:04Z","title":"Eyes Closed, Safety On: Protecting Multimodal LLMs via Image-to-Text Transformation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09572","snapshot_observed_at":"2026-08-16T10:29:59.048143Z","title":"Kwok, and Yu Zhang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.048143Z"},"links":{"cited_paper":"/paper/2403.09572","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:a9c4f52cc0c8f52aae654ec1f53ab8bc87a160c51d8bc8ac61d4fb1c12a08e33","observation_id":"d03a804c-7366-4312-a850-c99569fefb0a","resolution":{"observed_at":"2026-08-16T10:29:59.048143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05113","last_updated":"2025-06-06T17:08:12Z","snapshot_observed_at":"2026-08-18T12:58:14.839534Z","submitted_at":"2024-06-07T17:44:32Z","title":"LlavaGuard: An Open VLM-based Framework for Safeguarding Vision Datasets and Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05113","snapshot_observed_at":"2026-08-16T10:29:59.053086Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.053086Z"},"links":{"cited_paper":"/paper/2406.05113","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:21476b7d3227561a78976ea0ada985f1dcb6ba423249331c6a08d61d7c159ae2","observation_id":"5fb28a5f-78a2-4e0f-a880-986184cf5263","resolution":{"observed_at":"2026-08-16T10:29:59.053086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-08-14T15:42:19.849118Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-16T10:29:59.058063Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.058063Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:5040f2fa57ada8fdcecdded7d5859f32e01ef7c0828006646a40e2c155031d64","observation_id":"d9ec4943-39cd-4658-9888-fe8e4564d69f","resolution":{"observed_at":"2026-08-16T10:29:59.058063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:30:00.882797Z","title":null,"venue":null,"work_id":"66495605-3632-4059-830b-65fb9bbe3b9f","year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.063410Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:06a73bdc5c9b56eedde129fe1d3b918758ea40cf91b78611213505724a850c65","observation_id":"ac5a4299-35e7-47b3-a200-ecc7701696ad","resolution":{"observed_at":"2026-08-16T10:30:00.887901Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:30:00.866431Z","title":null,"venue":null,"work_id":"25730621-cd21-4708-9b3d-a08778f4485a","year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.068784Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:5845cf777941a505347d80e63430d0e4d0b905f21db77d1432d048992194e20d","observation_id":"7b4ded2a-73be-4701-a3db-19fe7e9c64e3","resolution":{"observed_at":"2026-08-16T10:30:00.871326Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:30:00.850474Z","title":null,"venue":null,"work_id":"e7d7cbd4-da27-40af-ad2a-9fe5409d0725","year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.073522Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:f94e1d759796198f07c26c9d121749220f0b2705dc8e5e28c33e3cf4bb4e27be","observation_id":"18e6de6f-c778-4753-be36-d24bb3a5ca3f","resolution":{"observed_at":"2026-08-16T10:30:00.855235Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12915","last_updated":"2024-01-23T17:07:18Z","snapshot_observed_at":"2026-08-16T14:25:08.079469Z","submitted_at":"2024-01-23T17:07:18Z","title":"Red Teaming Visual Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12915","snapshot_observed_at":"2026-08-16T10:29:59.078230Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.078230Z"},"links":{"cited_paper":"/paper/2401.12915","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:b561f935483662e2d5019ff4bd43e7d7d534c685b1c6090eecf9419f812ab0f3","observation_id":"34b1071f-a8e4-4e70-8624-c4bb8f6a79eb","resolution":{"observed_at":"2026-08-16T10:29:59.078230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14550","last_updated":"2024-11-05T16:51:40Z","snapshot_observed_at":"2026-08-16T13:41:00.212044Z","submitted_at":"2024-06-20T17:57:51Z","title":"GraphReader: Building Graph-based Agent to Enhance Long-Context Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14550","snapshot_observed_at":"2026-08-16T10:29:59.083147Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.083147Z"},"links":{"cited_paper":"/paper/2406.14550","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:a70d950732fb9074c999c490141bec30e9a25facf58a888414ef4c68575d48fc","observation_id":"7201b62d-4f52-4eaf-bfce-ccce2a59e927","resolution":{"observed_at":"2026-08-16T10:29:59.083147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19720","last_updated":"2024-10-25T17:47:35Z","snapshot_observed_at":"2026-08-16T13:05:53.096968Z","submitted_at":"2024-10-25T17:47:35Z","title":"2D-DPO: Scaling Direct Preference Optimization with 2-Dimensional Supervision","version":1},"cited_work":{"arxiv_id":"2410.19720","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.19720","snapshot_observed_at":"2026-08-16T10:30:00.177958Z","title":"2D-DPO: Scaling Direct Preference Optimization with 2-Dimensional Supervision","venue":"cs.CL","work_id":"1512cadb-8c54-4734-9640-f786613e19b7","year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.087909Z"},"links":{"cited_paper":"/paper/2410.19720","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:9c58e8d2236a21eb40b2e76c73fbce59e4d7c00bb6f559e44d4998969c87f885","observation_id":"754297b5-7d17-4251-9528-590a75c576a1","resolution":{"observed_at":"2026-08-16T10:30:00.183863Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:30:00.834328Z","title":null,"venue":null,"work_id":"4a9becad-db05-49d4-811a-69c164ae5c94","year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.092434Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:a8d94493bb3a1c1ff0af6e990adc60b12b48fd2be20e1ca300caff438b3a1dc6","observation_id":"1ada7bc9-fb86-482b-8448-842b150b5413","resolution":{"observed_at":"2026-08-16T10:30:00.839602Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17806","last_updated":"2024-06-22T23:26:07Z","snapshot_observed_at":"2026-08-16T13:40:28.142377Z","submitted_at":"2024-06-22T23:26:07Z","title":"MOSSBench: Is Your Multimodal Language Model Oversensitive to Safe Queries?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17806","snapshot_observed_at":"2026-08-16T10:29:59.096856Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.096856Z"},"links":{"cited_paper":"/paper/2406.17806","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:983399672a57135f08ac85f1579c33e4b85cf9ff80910a469cb2cac35a77ce38","observation_id":"7d65da0c-0b9f-4c82-a02c-41a53ee8ecfe","resolution":{"observed_at":"2026-08-16T10:29:59.096856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09792","last_updated":"2025-01-13T03:30:37Z","snapshot_observed_at":"2026-08-16T14:09:42.048334Z","submitted_at":"2024-03-14T18:24:55Z","title":"Images are Achilles' Heel of Alignment: Exploiting Visual Vulnerabilities for Jailbreaking Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09792","snapshot_observed_at":"2026-08-16T10:29:59.102631Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.102631Z"},"links":{"cited_paper":"/paper/2403.09792","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:c5b6f501f85a96496d3e962fe67a05144a131ad767cff8f0c8a14a44ffb49d38","observation_id":"b5c0eedf-30c6-4bb5-8717-2426ff33417c","resolution":{"observed_at":"2026-08-16T10:29:59.102631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:59.107689Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.107689Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:00aa262474692fd15482b208bbc1dd4e6c178dfeac3e5efe85c3339a86164c5d","observation_id":"e598a9fa-a54b-44f7-9d58-ff8a97d5c83b","resolution":{"observed_at":"2026-08-16T10:29:59.107689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03744","last_updated":"2024-05-15T19:22:44Z","snapshot_observed_at":"2026-08-15T02:35:59.111911Z","submitted_at":"2023-10-05T17:59:56Z","title":"Improved Baselines with Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03744","snapshot_observed_at":"2026-08-16T10:29:59.112050Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.112050Z"},"links":{"cited_paper":"/paper/2310.03744","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:d19373794bee0ad99eff3392edfd4b66a8656a510c25ae5c6b0e663007f1fd0d","observation_id":"d9023dbc-02ea-4a9c-89b1-50ee4d1943ef","resolution":{"observed_at":"2026-08-16T10:29:59.112050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11817","last_updated":"2024-06-17T17:55:38Z","snapshot_observed_at":"2026-08-16T13:42:07.921534Z","submitted_at":"2024-06-17T17:55:38Z","title":"Iterative Length-Regularized Direct Preference Optimization: A Case Study on Improving 7B Language Models to GPT-4 Level","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11817","snapshot_observed_at":"2026-08-16T10:29:59.116751Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.116751Z"},"links":{"cited_paper":"/paper/2406.11817","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:22f3ecaa46d44ba9eea83c33e479743dc091d6af0f8c9150e685d692b453b9b8","observation_id":"9bcdd601-1b87-48b2-96d2-d6190127beb1","resolution":{"observed_at":"2026-08-16T10:29:59.116751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17600","last_updated":"2024-06-19T08:32:14Z","snapshot_observed_at":"2026-08-16T14:39:16.502919Z","submitted_at":"2023-11-29T12:49:45Z","title":"MM-SafetyBench: A Benchmark for Safety Evaluation of Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17600","snapshot_observed_at":"2026-08-16T10:29:59.121834Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.121834Z"},"links":{"cited_paper":"/paper/2311.17600","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:f3f78b7a9127ae7b7c0eccb59b8b7a2064f1175492858d09e39f9c49b99b2b7d","observation_id":"a83073d4-886f-4d45-9300-16090a46f2ce","resolution":{"observed_at":"2026-08-16T10:29:59.121834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06281","last_updated":"2024-08-20T03:56:03Z","snapshot_observed_at":"2026-08-17T03:48:18.599994Z","submitted_at":"2023-07-12T16:23:09Z","title":"MMBench: Is Your Multi-modal Model an All-around Player?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06281","snapshot_observed_at":"2026-08-16T10:29:59.127382Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.127382Z"},"links":{"cited_paper":"/paper/2307.06281","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:e30556f9e6da7bd2d930c5736f616a1fa01aa7eeb695b080efc651b56625efc7","observation_id":"1ffa7a5d-a5a6-49bf-b707-3849dbe35b9c","resolution":{"observed_at":"2026-08-16T10:29:59.127382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13581","last_updated":"2024-05-22T12:21:27Z","snapshot_observed_at":"2026-08-16T13:50:39.114067Z","submitted_at":"2024-05-22T12:21:27Z","title":"Safety Alignment for Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13581","snapshot_observed_at":"2026-08-16T10:29:59.132998Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.132998Z"},"links":{"cited_paper":"/paper/2405.13581","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:2eab690e38d8df1b16ca1d03355f1f6ff7351974fe9646e9dc65a5a11b86f82a","observation_id":"11d60464-b52b-4b51-8f82-038bce3c60ec","resolution":{"observed_at":"2026-08-16T10:29:59.132998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09766","last_updated":"2024-03-14T17:59:35Z","snapshot_observed_at":"2026-08-17T23:55:53.742151Z","submitted_at":"2024-03-14T17:59:35Z","title":"An Image Is Worth 1000 Lies: Adversarial Transferability across Prompts on Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09766","snapshot_observed_at":"2026-08-16T10:29:59.138779Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.138779Z"},"links":{"cited_paper":"/paper/2403.09766","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:00c3cbde8f282db3587a71404b091663a659574d3038de9aeb681b45509ba521","observation_id":"7ff11a08-0e70-4305-b211-caff5fc8c12c","resolution":{"observed_at":"2026-08-16T10:29:59.138779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03027","last_updated":"2024-11-24T06:22:37Z","snapshot_observed_at":"2026-08-16T14:03:50.278504Z","submitted_at":"2024-04-03T19:23:18Z","title":"JailBreakV: A Benchmark for Assessing the Robustness of MultiModal Large Language Models against Jailbreak Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03027","snapshot_observed_at":"2026-08-16T10:29:59.144283Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.144283Z"},"links":{"cited_paper":"/paper/2404.03027","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:99e7e4a0787fe3688348ffee81e4eb0fa86c50730970ebbbf6cb3d3f80f96444","observation_id":"2af09d0a-8eca-4f13-a722-e47bb60bcdb5","resolution":{"observed_at":"2026-08-16T10:29:59.144283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17155","last_updated":"2024-03-25T20:12:02Z","snapshot_observed_at":"2026-08-17T05:42:38.127377Z","submitted_at":"2024-03-25T20:12:02Z","title":"Task-Agnostic Detector for Insertion-Based Backdoor Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17155","snapshot_observed_at":"2026-08-16T10:29:59.150098Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.150098Z"},"links":{"cited_paper":"/paper/2403.17155","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:58b822776f2bb444081d3fdf2de530e50fd5f256c914972702908dd3ed6e3136","observation_id":"e56c47f5-4c82-4002-9b79-4be3af792083","resolution":{"observed_at":"2026-08-16T10:29:59.150098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19232","last_updated":"2024-09-28T04:37:09Z","snapshot_observed_at":"2026-08-16T13:14:35.514274Z","submitted_at":"2024-09-28T04:37:09Z","title":"TrojVLM: Backdoor Attack Against Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19232","snapshot_observed_at":"2026-08-16T10:29:59.155145Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.155145Z"},"links":{"cited_paper":"/paper/2409.19232","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:e0c5300b92478520ece50c8feeb3ad84702e41c2fac0f80e6aaac0fcaa27154e","observation_id":"4502462c-5347-4648-a415-9bacf4086e6a","resolution":{"observed_at":"2026-08-16T10:29:59.155145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:30:00.806024Z","title":null,"venue":null,"work_id":"c777b695-69e4-4db7-8684-22eeb88ecc22","year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.159775Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:1e247f579b5588ee4f09ec1f42ce99934394b36d1a39a2076633f30b4eb9c4f4","observation_id":"8d47211b-1b88-4235-b13a-ce695deeeced","resolution":{"observed_at":"2026-08-16T10:30:00.810769Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:30:00.790647Z","title":null,"venue":null,"work_id":"b3da9d69-71ec-48d1-89b9-0a11df29de14","year":2022},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.164223Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:ab03dc5429910586c8700e0bc12beaa5a7bd514ff1a1fb1eb6c2a5556a2ca7b7","observation_id":"57336205-d557-4c31-ae11-e3d48cba736e","resolution":{"observed_at":"2026-08-16T10:30:00.795555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:30:00.775198Z","title":null,"venue":null,"work_id":"0f5a5ae2-93ca-4a96-a8f4-4b061894397c","year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.168916Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:3c6aa7b46753442852a6372ed318e5b9c3ee40e119976dcb4576ff4e267b6255","observation_id":"e294cb0b-df38-476e-a139-1425823e6f1b","resolution":{"observed_at":"2026-08-16T10:30:00.780044Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-08-16T09:07:20.265665Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-16T10:29:59.173229Z","title":"Forsyth, and Dan Hendrycks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.173229Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:3d288c70e2c9528331ca8b36993824d49a27da43d22c48c4c952567407571f9a","observation_id":"0804183a-8e3d-4dce-975c-b169cabd75af","resolution":{"observed_at":"2026-08-16T10:29:59.173229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:30:00.758396Z","title":null,"venue":null,"work_id":"fe90e405-b8ff-449a-b3fb-9a3503e5b649","year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.178635Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:ab4a54d61566aff3b797d33f5c243b5625deed82e7d7dc096a3dae207712355f","observation_id":"12bb00a4-1813-4fc4-8a45-c886f92bc5dd","resolution":{"observed_at":"2026-08-16T10:30:00.764280Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:30:00.740570Z","title":null,"venue":null,"work_id":"0be639b9-cacb-4ebf-a34b-6efc249a10ea","year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.184134Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:a7ec3e3b7f69fcf6cd4efb5c0bb36689371cf845640be356d99f57d3039039b0","observation_id":"dd5f31ad-3bb6-4dc2-94e5-5b7d306f9f80","resolution":{"observed_at":"2026-08-16T10:30:00.745782Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:30:00.725203Z","title":null,"venue":null,"work_id":"69fab90b-1d86-4530-aa35-7c66a45450d2","year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.188654Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:9d6eda8b8b943afebc282faf77c6540dfc9e4655f8a1a40449b57eedecc36d46","observation_id":"21770cc5-fb1b-4a52-94aa-67cf869777d5","resolution":{"observed_at":"2026-08-16T10:30:00.729901Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:30:00.709908Z","title":null,"venue":null,"work_id":"7af24598-b1d3-4c27-ae62-d12e9e6e3847","year":2020},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.193466Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:23501e9f8919337d158e9a6a0f646a26c638ef82d72024babebf1aa24b9f7147","observation_id":"1f79dd50-80cf-4678-b343-0fd7ac6a8045","resolution":{"observed_at":"2026-08-16T10:30:00.714621Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:30:00.695412Z","title":null,"venue":null,"work_id":"e29a2ad6-16ae-4c56-a710-54b35bf33a04","year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.197610Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:2abdbfd9bd44d0324f0999a6d02da4123ac7f44cbd8d844984104bacc46eadbd","observation_id":"4fcc994a-0ebf-4d38-b009-53ee54075103","resolution":{"observed_at":"2026-08-16T10:30:00.699931Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14824","last_updated":"2023-07-13T05:41:34Z","snapshot_observed_at":"2026-08-12T12:24:23.815073Z","submitted_at":"2023-06-26T16:32:47Z","title":"Kosmos-2: Grounding Multimodal Large Language Models to the World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14824","snapshot_observed_at":"2026-08-16T10:29:59.201777Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.201777Z"},"links":{"cited_paper":"/paper/2306.14824","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:69b5727f252e1864f477929ec6c40821a9c63523b15d854ca33e62ec87e57229","observation_id":"2f5b8a44-d811-4e7f-8b5e-1b1eb58037e7","resolution":{"observed_at":"2026-08-16T10:29:59.201777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02906","last_updated":"2024-06-17T16:53:49Z","snapshot_observed_at":"2026-08-17T22:09:41.799837Z","submitted_at":"2024-01-05T17:05:42Z","title":"MLLM-Protector: Ensuring MLLM's Safety without Hurting Performance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02906","snapshot_observed_at":"2026-08-16T10:29:59.206118Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.206118Z"},"links":{"cited_paper":"/paper/2401.02906","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:9ed38e179f9310f5dedd463a56bdbe3edf6d4f06533cb3d4ed35c52a2b77ccbf","observation_id":"9184d978-542a-4a2f-b138-26d8d6d3740c","resolution":{"observed_at":"2026-08-16T10:29:59.206118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:30:00.679615Z","title":null,"venue":null,"work_id":"ce93a201-13b5-4cd0-86d5-cbad20c9c593","year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.210999Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:2a058d7d80bb524002b902859704d9e4f5ee7de664a13a5e0b04be985dd9a65f","observation_id":"bbb4aa37-b4ca-468e-be4b-fdc5f2d6b759","resolution":{"observed_at":"2026-08-16T10:30:00.684205Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00626","last_updated":"2025-02-13T03:11:20Z","snapshot_observed_at":"2026-08-18T14:40:04.189787Z","submitted_at":"2024-02-01T14:41:20Z","title":"Vision-LLMs Can Fool Themselves with Self-Generated Typographic Attacks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00626","snapshot_observed_at":"2026-08-16T10:29:59.215890Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.215890Z"},"links":{"cited_paper":"/paper/2402.00626","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:26690d732b970ebe9bd9d31d5d71d073d2b14f653ba995a0d12b2eda3f9a2d43","observation_id":"ec910c25-2acc-46c2-800f-63bcc9600935","resolution":{"observed_at":"2026-08-16T10:29:59.215890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:59.221062Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.221062Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:afacf5936fcf30080f0e3e84b033248737fa3f5d3c3c3585a425bb2b8dcf5df8","observation_id":"1543a04e-4dfd-4404-96d1-3604b461394c","resolution":{"observed_at":"2026-08-16T10:29:59.221062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:59.225273Z","title":"Manning, Stefano Ermon, and Chelsea Finn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.225273Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:82124eaefbf6845d47427aa61e3ce16fba6edbbf76947da1724ab2f4f3ffc25e","observation_id":"8676ace5-dbef-4beb-b254-dc046f8c6d6c","resolution":{"observed_at":"2026-08-16T10:29:59.225273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17423","last_updated":"2026-06-24T07:49:12Z","snapshot_observed_at":"2026-08-16T13:48:56.031830Z","submitted_at":"2024-05-27T17:59:25Z","title":"Privacy-Aware Visual Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17423","snapshot_observed_at":"2026-08-16T10:29:59.230542Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.230542Z"},"links":{"cited_paper":"/paper/2405.17423","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:12cc92bc9e30a60765fa4b2ca9f456f6e720d9ed449f53c774ca2c9890da3bd5","observation_id":"eaf57920-81b8-40d6-8a07-4ee4aa92fd2f","resolution":{"observed_at":"2026-08-16T10:29:59.230542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-16T10:29:59.235695Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.235695Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:6fb75737b72cff43607ffa44cbf8a347a5201ed8122653a7d4fca7bdc3ec9bf0","observation_id":"eb05220e-52e1-426e-9039-a42c89752871","resolution":{"observed_at":"2026-08-16T10:29:59.235695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:59.240877Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.240877Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:65bdbc1c10ea5e9ecc93418edc44cb0d1277645ec9bb4b47e1d940f53919ca51","observation_id":"da963c02-f5ce-4f58-875d-b4827d04ef15","resolution":{"observed_at":"2026-08-16T10:29:59.240877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-16T10:29:59.245927Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.245927Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:4276bdc6dc1713dd39c77109e40a27e1af0b32f8fccaec3d4890fe6987a139ff","observation_id":"aedcd443-720b-453f-876c-57183f47f159","resolution":{"observed_at":"2026-08-16T10:29:59.245927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16101","last_updated":"2023-11-27T18:59:42Z","snapshot_observed_at":"2026-08-18T17:14:25.386130Z","submitted_at":"2023-11-27T18:59:42Z","title":"How Many Unicorns Are in This Image? A Safety Evaluation Benchmark for Vision LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16101","snapshot_observed_at":"2026-08-16T10:29:59.250602Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.250602Z"},"links":{"cited_paper":"/paper/2311.16101","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:e5db3694bb6d2a0a3e49db843ec5328460a587155043d62ee3297c279068be8f","observation_id":"828726e6-328c-4a8a-9ecf-29d4a5569377","resolution":{"observed_at":"2026-08-16T10:29:59.250602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-16T10:29:59.255476Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.255476Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:827b7d5d43d3304abcb3b0add9d4f833920b50f66c7762e816c03c890d3cb894","observation_id":"b7136024-4a0f-43f2-aba8-a883317281a3","resolution":{"observed_at":"2026-08-16T10:29:59.255476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11206","last_updated":"2024-01-20T10:41:03Z","snapshot_observed_at":"2026-08-16T14:25:56.925750Z","submitted_at":"2024-01-20T10:41:03Z","title":"InferAligner: Inference-Time Alignment for Harmlessness through Cross-Model Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11206","snapshot_observed_at":"2026-08-16T10:29:59.260099Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.260099Z"},"links":{"cited_paper":"/paper/2401.11206","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:d4d0a4d7e5cbff522f6ee5fb8e8b56baea9a06fb9e2c649914eb3e394905ee80","observation_id":"cc2f6355-a0dd-41f2-b6f7-3a0ce5fc7f91","resolution":{"observed_at":"2026-08-16T10:29:59.260099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15279","last_updated":"2025-02-17T03:38:42Z","snapshot_observed_at":"2026-08-16T13:40:41.378998Z","submitted_at":"2024-06-21T16:14:15Z","title":"Safe Inputs but Unsafe Output: Benchmarking Cross-modality Safety Alignment of Large Vision-Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15279","snapshot_observed_at":"2026-08-16T10:29:59.265087Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.265087Z"},"links":{"cited_paper":"/paper/2406.15279","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:9d7357f383fba6dd7cdd2294ad0e203cfaa4258ad5925f25fef9ce96dfec6aa0","observation_id":"843de802-8fef-408b-a208-006bb50228d5","resolution":{"observed_at":"2026-08-16T10:29:59.265087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09513","last_updated":"2024-03-14T15:57:13Z","snapshot_observed_at":"2026-08-18T00:55:41.043271Z","submitted_at":"2024-03-14T15:57:13Z","title":"AdaShield: Safeguarding Multimodal Large Language Models from Structure-based Attack via Adaptive Shield Prompting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09513","snapshot_observed_at":"2026-08-16T10:29:59.269688Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.269688Z"},"links":{"cited_paper":"/paper/2403.09513","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:b4f6e6cde82f570062bac9e1fcd749ac8589ebb2e9fee4bf95793abcf444dd0b","observation_id":"09b4c3f0-9275-4e1e-be3e-070b3dbb123a","resolution":{"observed_at":"2026-08-16T10:29:59.269688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14660","last_updated":"2024-02-23T07:13:00Z","snapshot_observed_at":"2026-08-16T14:16:12.270964Z","submitted_at":"2024-02-22T16:06:49Z","title":"ConceptMath: A Bilingual Concept-wise Benchmark for Measuring Mathematical Reasoning of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14660","snapshot_observed_at":"2026-08-16T10:29:59.274420Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.274420Z"},"links":{"cited_paper":"/paper/2402.14660","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:ac8e9e56e62e551405e16379353685f6533c11206ed66dc3405fc1866a078a59","observation_id":"a667b95c-f065-40ed-9633-ac9b522fb94b","resolution":{"observed_at":"2026-08-16T10:29:59.274420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:59.279014Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.279014Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:58282b66007c20735e9de5fa2a4a0cc2bd2be02d46f7776491c58e5726eeed8f","observation_id":"8d74e4e2-32eb-40f5-a239-97160921d891","resolution":{"observed_at":"2026-08-16T10:29:59.279014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:30:00.625831Z","title":null,"venue":null,"work_id":"c0c056f7-f82d-4f85-8b21-0ab0b3d77800","year":2022},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.284191Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:63bc339ad1af1fb4da483fbfc1ae821975921c90e45b0be8a234d5d6f27d604d","observation_id":"b2e5acda-cf48-41a7-9b76-1b5b6242cba4","resolution":{"observed_at":"2026-08-16T10:30:00.630807Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-16T10:29:59.288629Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.288629Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:af3c8be3aeb37d22dc91d7c0031f04200d7021f8a2f1a62a10db9a83036761ab","observation_id":"d145773c-6b39-4f39-abeb-280470ae7451","resolution":{"observed_at":"2026-08-16T10:29:59.288629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:30:00.610546Z","title":null,"venue":null,"work_id":"3bc771ee-ca75-4819-a1cb-e2b07153aa8a","year":2025},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.294663Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:b0126f2e0226c4a4736245613b0a60159085202b5120e12f3f1e2373a0f9c813","observation_id":"56615a39-b363-45a7-bc3b-f271aa4115f5","resolution":{"observed_at":"2026-08-16T10:30:00.615290Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:59.299257Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.299257Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:720928dcbe4469b133949ea090b055676fbbfaba3d21d23c6936f060d1cdac77","observation_id":"eae13ea7-2212-4157-840a-b421c95babeb","resolution":{"observed_at":"2026-08-16T10:29:59.299257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:30:00.585352Z","title":null,"venue":null,"work_id":"5b3c558f-10a6-4eb6-9e1a-2078497e64f2","year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.303416Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:d5368fb1dec40697a12fd1e0698be838ffecf448369843509433e2b1d4447c3d","observation_id":"2da26ba0-46fb-42b6-87c2-d4b4ccee9f55","resolution":{"observed_at":"2026-08-16T10:30:00.590160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:59.307889Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.307889Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:99f48c95bb4f6e369b69c8faab4d4311aabc6fbcdb70c039d155d25097b71281","observation_id":"a7eefa9e-03c1-4ac7-8d79-0db22f695ebf","resolution":{"observed_at":"2026-08-16T10:29:59.307889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.748","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:59.406852Z","title":null,"venue":null,"work_id":"a9dd502e-4bc7-47e7-a824-36824686b689","year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.312090Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:1fc5fac8a7b710c11e3227ea32bec6ee2574ac696950c498809015bf7b44ff79","observation_id":"2f6ad466-de22-4fd4-b232-bb27ac31ab8e","resolution":{"observed_at":"2026-08-16T10:29:59.413268Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02746","last_updated":"2024-12-23T05:43:01Z","snapshot_observed_at":"2026-08-16T13:46:07.455470Z","submitted_at":"2024-06-04T20:02:52Z","title":"RATT: A Thought Structure for Coherent and Correct LLM Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02746","snapshot_observed_at":"2026-08-16T10:29:59.316516Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.316516Z"},"links":{"cited_paper":"/paper/2406.02746","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:ce8f0abdfdbb1baee322c905631b663395b2692064e183aa09edfe6682bd236d","observation_id":"ff745b42-e919-413e-917f-7e9ea2559edd","resolution":{"observed_at":"2026-08-16T10:29:59.316516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10766","last_updated":"2025-03-15T00:49:45Z","snapshot_observed_at":"2026-08-16T14:34:00.099983Z","submitted_at":"2023-12-17T17:02:14Z","title":"JailGuard: A Universal Detection Framework for LLM Prompt-based Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10766","snapshot_observed_at":"2026-08-16T10:29:59.321345Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.321345Z"},"links":{"cited_paper":"/paper/2312.10766","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:d906186655cfc6cef488862939f6d3b7cb0dac5937aec387840f059f9d04d125","observation_id":"5d881f95-076f-404d-9802-470245054a55","resolution":{"observed_at":"2026-08-16T10:29:59.321345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:59.326126Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.326126Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:f8b00bd6e3de405ead2d7b81cd3ea0968fcca5283384a8255c68177f69478ab9","observation_id":"e13a54c2-2ee4-45ef-bc19-39809676faea","resolution":{"observed_at":"2026-08-16T10:29:59.326126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12030","last_updated":"2025-05-21T04:55:10Z","snapshot_observed_at":"2026-08-17T05:28:50.285614Z","submitted_at":"2024-06-17T18:57:37Z","title":"SPA-VL: A Comprehensive Safety Preference Alignment Dataset for Vision Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12030","snapshot_observed_at":"2026-08-16T10:29:59.331297Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.331297Z"},"links":{"cited_paper":"/paper/2406.12030","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:a8a25776a72907b2ca212dce4b0480d84001e6853b8934c5baaa8d384108634b","observation_id":"54153688-e3aa-42d4-8156-c713dfaa01b6","resolution":{"observed_at":"2026-08-16T10:29:59.331297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09037","last_updated":"2024-07-17T05:54:38Z","snapshot_observed_at":"2026-08-16T14:09:59.030614Z","submitted_at":"2024-03-14T02:25:35Z","title":"The First to Know: How Token Distributions Reveal Hidden Knowledge in Large Vision-Language Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09037","snapshot_observed_at":"2026-08-16T10:29:59.336577Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.336577Z"},"links":{"cited_paper":"/paper/2403.09037","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:41ba879f09470f48a8d33197e66555bc0e8c56bdb49ed79583ee2287099cd9e5","observation_id":"05d84306-305f-433d-905b-8d7060698a2c","resolution":{"observed_at":"2026-08-16T10:29:59.336577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:59.343407Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.343407Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:f25d6ceb40a418fc3d5c870f055a0aa0c6cfde33de5afc548684a95d41bcbcbb","observation_id":"1b1d460c-baa6-413c-81ce-23e3d40836db","resolution":{"observed_at":"2026-08-16T10:29:59.343407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:30:00.558734Z","title":"On the existence of a trojaned twin model","venue":null,"work_id":"4b8907d9-8a45-4a50-a371-7ec94bbf0892","year":null},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.348203Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:26eeeb82943f11aff10dcf18a2e48579b28aeafe08ab04ab21a6d51b0dae0e53","observation_id":"89248376-634e-4e7a-8192-0a7a736028b8","resolution":{"observed_at":"2026-08-16T10:30:00.564068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05210","last_updated":"2025-05-28T19:42:17Z","snapshot_observed_at":"2026-08-17T07:58:29.556919Z","submitted_at":"2025-02-03T19:26:44Z","title":"Regression and Forecasting of U.S. Stock Returns Based on LSTM","version":3},"cited_work":{"arxiv_id":"2502.05210","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.05210","snapshot_observed_at":"2026-08-16T10:29:59.464745Z","title":"Regression and Forecasting of U.S. Stock Returns Based on LSTM","venue":"q-fin.ST","work_id":"47cb69b2-a6db-4625-ac54-616bcef6715b","year":2025},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.353452Z"},"links":{"cited_paper":"/paper/2502.05210","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:51dc3d833254c635cb9d7bbfa45ad1433e3041ef016e4810d745a06ee72ee3c3","observation_id":"bfdbd885-c1c4-424c-9c28-2c4bb19c5599","resolution":{"observed_at":"2026-08-16T10:29:59.471023Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-16T14:21:50.770067Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-08-16T10:29:59.358383Z","title":"Hospedales","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.358383Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:3eb4b6ad7db18b2ef3e6c98a94dcbe2f40bcd4db19298dde4cbb81618b8f9e53","observation_id":"2fe48823-906f-4092-b583-8ed8049551ba","resolution":{"observed_at":"2026-08-16T10:29:59.358383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-16T10:29:59.363129Z","title":"Zico Kolter, and Matt Fredrikson","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.363129Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:8f7c709cd4e36712066a6b1179f0ae340273b5b90012ac80669f4279ce095787","observation_id":"2758b88b-1a74-458d-af51-b1f601befb28","resolution":{"observed_at":"2026-08-16T10:29:59.363129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:59.367786Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.367786Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:406bd86aa6d882cb16ab55acff0c0e3e8edb945ef797a8aa740d5cb0b189423b","observation_id":"ccdc77a8-50d3-49fb-9e8f-9ad8a0fc093d","resolution":{"observed_at":"2026-08-16T10:29:59.367786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:59.372879Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models","version":2},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:59.372879Z"},"links":{"citing_paper":"/paper/2504.18053"},"observation_digest":"sha256:baccb1ddaacf6d870cfc43ea916741a98faea5a4da54c9bbd678555aaa760c8b","observation_id":"5aa8a94e-b269-4913-bb55-f2b4b998dc63","resolution":{"observed_at":"2026-08-16T10:29:59.372879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.18053","last_updated":"2025-06-05T16:13:05Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T00:01:48.383371Z","submitted_at":"2025-04-25T03:54:24Z","title":"DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models"},"reference_resolution":{"displayed":82,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":77,"verified_exact":4,"verified_fuzzy":1},"total_outbound_references":82},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 82 of 82 outbound references and 2 inbound Pith citation observations for arXiv:2504.18053."}