{"as_of":"2026-08-09T04:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b82d0ced645fd8b336784795d46447e75259398ab8218861cb0798e8932d3a0e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":27,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T15:38:17.335773Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T00:39:16.634455Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.02207","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-07-04T00:39:16.634455Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models","venue":null,"work_id":"fa73b2d0-676c-4494-a528-ee3d216fd3b8","year":2024},"citing_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T20:19:27.255515Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2404.14219"},"observation_digest":"sha256:eb6cbc700b21cc767b7d111538272f4e6c726523c5d89b8142339853891df1be","observation_id":"d7a3d07d-855a-4e34-95f5-14b1e8d80198","resolution":{"observed_at":"2026-05-10T20:19:27.304004Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.02207","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-07-04T00:39:16.634455Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models","venue":null,"work_id":"fa73b2d0-676c-4494-a528-ee3d216fd3b8","year":2024},"citing_paper":{"arxiv_id":"2409.18169","last_updated":"2026-04-23T18:48:49Z","snapshot_observed_at":"2026-07-06T19:22:58.341345Z","submitted_at":"2024-09-26T17:55:22Z","title":"Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey","version":6},"reference_index":183,"source":"pdf_text","source_observed_at":"2026-05-23T20:58:16.237327Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2409.18169"},"observation_digest":"sha256:f4cee23f1581da63f33e8a59d412cf44e5b9fb6d357f973f490c75964739f818","observation_id":"a8c50b2c-35f0-4872-aab9-a53c76c3262e","resolution":{"observed_at":"2026-05-23T20:58:25.915671Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-08-08T15:38:17.335773Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06390","last_updated":"2025-02-11T04:42:24Z","snapshot_observed_at":"2026-08-08T15:33:58.231746Z","submitted_at":"2025-02-10T12:20:08Z","title":"When Data Manipulation Meets Attack Goals: An In-depth Survey of Attacks for VLMs","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-08T15:38:17.335773Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2502.06390"},"observation_digest":"sha256:eb01add6c84b565ed62c69984a46685375c97ffbec3a76ea076f48b9c15e9695","observation_id":"5fa57646-fe9f-4fef-ae7e-95bd036355e5","resolution":{"observed_at":"2026-08-08T15:38:17.335773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-08-07T18:23:50.561901Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10391","last_updated":"2025-02-14T18:59:51Z","snapshot_observed_at":"2026-08-08T01:24:46.892879Z","submitted_at":"2025-02-14T18:59:51Z","title":"MM-RLHF: The Next Step Forward in Multimodal LLM Alignment","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T18:23:50.561901Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2502.10391"},"observation_digest":"sha256:e352ade268c7e633dd341494c8cf0df22c24afe92eebfe4d7d05060e7de69b6b","observation_id":"bf4c39da-e164-4a99-8e60-4ee06a4b2c4c","resolution":{"observed_at":"2026-08-07T18:23:50.561901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-08-07T19:45:18.653326Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large lan- guage models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.14881","last_updated":"2025-02-14T08:42:43Z","snapshot_observed_at":"2026-08-07T22:02:21.919237Z","submitted_at":"2025-02-14T08:42:43Z","title":"A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T19:45:18.653326Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2502.14881"},"observation_digest":"sha256:21baf3e466ac7ad1d46d735878e530d230c3db7ac9eb54c966b9b7c51bede11d","observation_id":"e1a1672a-9ef9-4020-833a-cd655bfca1ab","resolution":{"observed_at":"2026-08-07T19:45:18.653326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.02207","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-07-04T00:39:16.634455Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models","venue":null,"work_id":"fa73b2d0-676c-4494-a528-ee3d216fd3b8","year":2024},"citing_paper":{"arxiv_id":"2503.01743","last_updated":"2025-03-07T09:05:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-03T17:05:52Z","title":"Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-11T22:22:27.455361Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2503.01743"},"observation_digest":"sha256:06bf4389a27040a8cca658b5608962543f6db971a1bf0d4db444020c412493cf","observation_id":"8483c4d9-565f-4c1c-a4cd-6bf3729d0d31","resolution":{"observed_at":"2026-05-11T22:22:27.772873Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-08-07T14:13:13.390836Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20362","last_updated":"2025-05-26T09:01:46Z","snapshot_observed_at":"2026-08-07T14:05:21.829543Z","submitted_at":"2025-05-26T09:01:46Z","title":"VSCBench: Bridging the Gap in Vision-Language Model Safety Calibration","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:13.390836Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2505.20362"},"observation_digest":"sha256:c29293b0d5d9bc24675df9acfda6977102584046058f0b3a3c80b976247023d9","observation_id":"ce6b2979-7bd1-4c8c-8804-4e63a1728c37","resolution":{"observed_at":"2026-08-07T14:13:13.390836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-08-07T13:22:03.217330Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21967","last_updated":"2025-05-28T04:43:39Z","snapshot_observed_at":"2026-08-08T01:18:33.252536Z","submitted_at":"2025-05-28T04:43:39Z","title":"Seeing the Threat: Vulnerabilities in Vision-Language Models to Adversarial Attack","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:03.217330Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2505.21967"},"observation_digest":"sha256:257655814dd97d09f509b1dca266fb8648c4f67cf4f1aa19900364740db4657c","observation_id":"d7030a2a-6b04-40d9-aa36-666ba7ecdcdf","resolution":{"observed_at":"2026-08-07T13:22:03.217330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-08-07T12:37:22.785969Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models.arXiv preprint arXiv:2402.02207,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24208","last_updated":"2025-05-30T04:40:08Z","snapshot_observed_at":"2026-08-08T01:25:52.362186Z","submitted_at":"2025-05-30T04:40:08Z","title":"Bootstrapping LLM Robustness for VLM Safety via Reducing the Pretraining Modality Gap","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:37:22.785969Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2505.24208"},"observation_digest":"sha256:b6ce15d3e2154590d024239bbc628e7610cd868bd885330994c4032aa612ac4b","observation_id":"eb3ea9cb-e2c6-4341-a225-4e1d40090c0e","resolution":{"observed_at":"2026-08-07T12:37:22.785969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-08-06T23:59:57.357277Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models.arXiv preprint arXiv:2402.02207,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.15606","last_updated":"2025-07-25T18:57:36Z","snapshot_observed_at":"2026-08-08T11:12:53.503626Z","submitted_at":"2025-06-18T16:30:02Z","title":"LoX: Low-Rank Extrapolation Robustifies LLM Safety Against Fine-tuning","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:59:57.357277Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2506.15606"},"observation_digest":"sha256:ea80dc5149107eaf349e58c6e12d2d584dea084b47e009941e644c22078b303a","observation_id":"e8bbe007-6169-48fa-8d86-030ac4ed2cb4","resolution":{"observed_at":"2026-08-06T23:59:57.357277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-08-06T12:09:39.851015Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-06T15:54:16.679483Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.851015Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:7c7db6b2b195843f92e083633943fbe168bdfb9edea34f2a998e6a7f8c793c68","observation_id":"2429dbe8-2f4d-407a-ba74-8daf01e091ec","resolution":{"observed_at":"2026-08-06T12:09:39.851015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-08-04T09:47:25.752076Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models.arXiv preprint arXiv:2402.02207,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.13698","last_updated":"2026-07-14T06:18:50Z","snapshot_observed_at":"2026-08-07T12:08:13.873562Z","submitted_at":"2025-10-15T15:57:17Z","title":"Attention Misses Visual Risk: Risk-Adaptive Steering for Multimodal Safety Alignment","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T09:47:25.752076Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2510.13698"},"observation_digest":"sha256:22721ee57e28b56690eb3c01117a7a9186c3285ac9bf3da928de5a4861d7e91c","observation_id":"bf2017b8-9f15-4b28-8d26-e7b6bd44b6bf","resolution":{"observed_at":"2026-08-04T09:47:25.752076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.02207","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-07-04T00:39:16.634455Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models","venue":null,"work_id":"fa73b2d0-676c-4494-a528-ee3d216fd3b8","year":2024},"citing_paper":{"arxiv_id":"2605.01449","last_updated":"2026-05-02T13:56:50Z","snapshot_observed_at":"2026-08-03T12:34:05.607551Z","submitted_at":"2026-05-02T13:56:50Z","title":"VisInject: Disruption != Injection -- A Dual-Dimension Evaluation of Universal Adversarial Attacks on Vision-Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-09T14:24:48.999632Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2605.01449"},"observation_digest":"sha256:6325c41e7440ca70e9cafdc4a80a8f2361f8edab293d5f76d65ecba63c4a77d3","observation_id":"1221b4cb-e16b-48f8-ad78-319fbd1f8d79","resolution":{"observed_at":"2026-05-11T16:56:08.104516Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.02207","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-07-04T00:39:16.634455Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models","venue":null,"work_id":"fa73b2d0-676c-4494-a528-ee3d216fd3b8","year":2024},"citing_paper":{"arxiv_id":"2605.11716","last_updated":"2026-05-12T08:05:10Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T08:05:10Z","title":"SafeSteer: A Decoding-level Defense Mechanism for Multimodal Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-13T06:56:10.053418Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2605.11716"},"observation_digest":"sha256:9b37e92a5f5342652af8deb88cdf6cc5bd8bf61dd15e3c962d910cd5faea6421","observation_id":"50a962c4-c771-4438-98eb-8eb5bb46a5d3","resolution":{"observed_at":"2026-05-13T06:57:27.567797Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.02207","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-07-04T00:39:16.634455Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models","venue":null,"work_id":"fa73b2d0-676c-4494-a528-ee3d216fd3b8","year":2024},"citing_paper":{"arxiv_id":"2605.16403","last_updated":"2026-05-13T05:00:19Z","snapshot_observed_at":"2026-07-06T23:27:34.514541Z","submitted_at":"2026-05-13T05:00:19Z","title":"When Vision Speaks for Sound","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-20T22:12:52.160596Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2605.16403"},"observation_digest":"sha256:9e1aea0b65e327f3685a83ee32949645bf24a2a42995c067712bc35ea22cc0d6","observation_id":"32ee3930-4fa1-4a5c-a920-8e1f3c209439","resolution":{"observed_at":"2026-05-20T22:13:46.890434Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.02207","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-07-04T00:39:16.634455Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models","venue":null,"work_id":"fa73b2d0-676c-4494-a528-ee3d216fd3b8","year":2024},"citing_paper":{"arxiv_id":"2605.17128","last_updated":"2026-05-16T19:22:54Z","snapshot_observed_at":"2026-08-02T02:37:40.373827Z","submitted_at":"2026-05-16T19:22:54Z","title":"New Wide-Net-Casting Jailbreak Attacks Risk Large Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T14:46:52.070071Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2605.17128"},"observation_digest":"sha256:05d96201ac6fba0a02f16fddb568857342da424b20345db559beb8c2da9ef6d1","observation_id":"d7ac1984-15fb-4452-9c8d-85fd12cb450a","resolution":{"observed_at":"2026-05-20T14:48:23.282107Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.02207","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-07-04T00:39:16.634455Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models","venue":null,"work_id":"fa73b2d0-676c-4494-a528-ee3d216fd3b8","year":2024},"citing_paper":{"arxiv_id":"2605.17310","last_updated":"2026-05-17T08:02:27Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T08:02:27Z","title":"Attention Hijacking: Response Manipulation Across Queries in Vision-Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-20T14:25:10.603780Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2605.17310"},"observation_digest":"sha256:2101bc40f2197fbdb5fbd81f4d44c37fbe054b11a2eb7ff060de872f3de2e99f","observation_id":"17dedf34-b8d5-43ac-9625-8babb5a25583","resolution":{"observed_at":"2026-05-20T14:28:21.653719Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.02207","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-07-04T00:39:16.634455Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models","venue":null,"work_id":"fa73b2d0-676c-4494-a528-ee3d216fd3b8","year":2024},"citing_paper":{"arxiv_id":"2606.02530","last_updated":"2026-06-01T17:38:12Z","snapshot_observed_at":"2026-08-05T11:28:53.105574Z","submitted_at":"2026-06-01T17:38:12Z","title":"SafeSteer: Localized On-Policy Distillation for Efficient Safety Alignment","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-06-28T14:39:11.178976Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2606.02530"},"observation_digest":"sha256:77958b0783a0da072b4edc10a31fe9bba0c13d61469a3a43c898cd732d612a26","observation_id":"19a1efc1-61d2-455c-a265-ffd6b2611629","resolution":{"observed_at":"2026-07-01T23:06:20.936544Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.02207","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-07-04T00:39:16.634455Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models","venue":null,"work_id":"fa73b2d0-676c-4494-a528-ee3d216fd3b8","year":2024},"citing_paper":{"arxiv_id":"2606.03089","last_updated":"2026-06-16T07:22:07Z","snapshot_observed_at":"2026-07-06T23:43:22.513369Z","submitted_at":"2026-06-02T03:17:56Z","title":"Constitutional On-Policy Safe Distillation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-28T11:47:14.135793Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2606.03089"},"observation_digest":"sha256:a7d7c95878067312460252ee28f8d69432f40816aeef2395354e2c3240b662ba","observation_id":"7681ac16-98ff-4654-9fab-b42a903747be","resolution":{"observed_at":"2026-07-02T01:36:25.407430Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.02207","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-07-04T00:39:16.634455Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models","venue":null,"work_id":"fa73b2d0-676c-4494-a528-ee3d216fd3b8","year":2024},"citing_paper":{"arxiv_id":"2606.07970","last_updated":"2026-06-06T04:04:57Z","snapshot_observed_at":"2026-07-06T23:47:33.680573Z","submitted_at":"2026-06-06T04:04:57Z","title":"Defending Against Malicious Finetuning by Scaling Train-time Adversarial Attacks","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-27T20:10:25.375603Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2606.07970"},"observation_digest":"sha256:2a9305459ba81d0fece09fe4b03938c72c7c8f81cc2a27600c7976f76f097bc3","observation_id":"963082fe-a130-41cd-a8ba-16e83fc9f647","resolution":{"observed_at":"2026-07-02T20:47:22.922495Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.02207","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-07-04T00:39:16.634455Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models","venue":null,"work_id":"fa73b2d0-676c-4494-a528-ee3d216fd3b8","year":2024},"citing_paper":{"arxiv_id":"2606.09125","last_updated":"2026-06-08T07:19:42Z","snapshot_observed_at":"2026-07-06T23:48:30.569726Z","submitted_at":"2026-06-08T07:19:42Z","title":"Unveiling Privacy Risks in Multi-modal Large Language Models: Task-specific Vulnerabilities and Mitigation Challenges","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-06-27T16:33:28.848573Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2606.09125"},"observation_digest":"sha256:27deeb4e59e5a9a3bc905dadcc3abd86c89fd32bc40c0a0a68d73cdf28b2b652","observation_id":"b03194f8-4fab-4c20-8960-01ce3c01d358","resolution":{"observed_at":"2026-07-03T01:27:30.930139Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.02207","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-07-04T00:39:16.634455Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models","venue":null,"work_id":"fa73b2d0-676c-4494-a528-ee3d216fd3b8","year":2024},"citing_paper":{"arxiv_id":"2606.18632","last_updated":"2026-06-17T03:03:16Z","snapshot_observed_at":"2026-08-06T23:11:06.200451Z","submitted_at":"2026-06-17T03:03:16Z","title":"ROBOSHACKLES: A Safety Dataset for Human-Injury Prevention in Embodied Foundation Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-26T21:06:54.022715Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2606.18632"},"observation_digest":"sha256:03ed57cc087c95cb76aadcddea01d17023a718402e990f5c6ada9e2498ba7a29","observation_id":"1e3f848c-fe44-4608-a4b8-3781ff6f3008","resolution":{"observed_at":"2026-07-04T00:39:16.636275Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-07-14T17:33:49.041193Z","title":"arXiv preprint arXiv:2402.02207 (2024) OutGuard 19 A Appendix A.1 Overview of Appendix A –Appendix A.1 Appendix overview","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09697","last_updated":"2026-06-20T12:09:13Z","snapshot_observed_at":"2026-08-08T10:05:10.130285Z","submitted_at":"2026-06-20T12:09:13Z","title":"Safe responses matter: Output-aware safety guardrail mitigate over-refusal in MLLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-14T17:33:49.041193Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2607.09697"},"observation_digest":"sha256:85564e0b9cc952389ae82c45a289f8584e40a90996fa43fd717a199348262351","observation_id":"9f7c5791-3228-4039-ab3d-795e5fbf26a5","resolution":{"observed_at":"2026-07-14T17:33:49.041193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-08-01T08:23:27.722142Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21151","last_updated":"2026-07-26T23:23:12Z","snapshot_observed_at":"2026-08-06T16:53:45.184525Z","submitted_at":"2026-07-23T10:35:38Z","title":"V-DEAL: Diagnosing Video Safety De-Calibration as an Understanding-Refusal Coupling Failure","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T08:23:27.722142Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2607.21151"},"observation_digest":"sha256:370ce8fd95c5a6e32279ea8ef27da0262dcfce297d40293b00a860a6e5beef4a","observation_id":"7e02f988-e635-400b-a83d-0e25b20f020b","resolution":{"observed_at":"2026-08-01T08:23:27.722142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-07-31T23:07:40.461286Z","title":"arXiv preprint arXiv:2402.02207 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27917","last_updated":"2026-07-30T09:30:03Z","snapshot_observed_at":"2026-08-07T15:15:58.184585Z","submitted_at":"2026-07-30T09:30:03Z","title":"One Anchor for All: Unified Multilingual and Multimodal Safety Alignment for LVLMs","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-31T23:07:40.461286Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2607.27917"},"observation_digest":"sha256:684185c0e72ac18b90016c6abc7eba77edfd4527fa4623c7fa57be564cebedda","observation_id":"f0361a0a-a3ba-47dc-a2d9-4bdd3ed26e80","resolution":{"observed_at":"2026-07-31T23:07:40.461286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-08-07T00:14:51.629463Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04034","last_updated":"2026-08-03T02:28:52Z","snapshot_observed_at":"2026-08-09T03:07:12.142624Z","submitted_at":"2026-08-03T02:28:52Z","title":"A Multimodal Automatic Redteaming Evaluation based on Atomic Jailbreak Strategy Decoupling and Combination","version":1},"reference_index":165,"source":"arxiv_source","source_observed_at":"2026-08-07T00:14:51.629463Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2608.04034"},"observation_digest":"sha256:db5cb16779f66d5ea2b6b5972f2e60b98369e12db7e2c65b8cd87e2319d4006b","observation_id":"647a6d08-e704-4322-adac-17452bb3262e","resolution":{"observed_at":"2026-08-07T00:14:51.629463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-08-06T10:46:10.797684Z","title":"arXiv preprint arXiv:2402.02207 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05045","last_updated":"2026-08-05T16:55:59Z","snapshot_observed_at":"2026-08-08T23:13:50.307997Z","submitted_at":"2026-08-05T16:55:59Z","title":"Gradient Immunity: Null-Space Resistance to Malicious Fine-Tuning","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-06T10:46:10.797684Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2608.05045"},"observation_digest":"sha256:9cfeea079e50a8c899004287cb0768ec3f262ee43fdc9445df2059e958174e2f","observation_id":"a2b8fe25-7ebe-41b8-95d7-33b9b1ea1b7a","resolution":{"observed_at":"2026-08-06T10:46:10.797684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.02207/citation-record","integrity":"/paper/2402.02207/integrity","json":"/paper/2402.02207/citation-record.json","paper":"/paper/2402.02207"},"outbound":[],"paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T10:51:37.619464Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 27 inbound Pith citation observations for arXiv:2402.02207."}