{"as_of":"2026-08-23T22:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:89ba43b4a8c68b7220813b8c60be8b8075f0095a67b96bfe481b94980260280d","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T19:41:19.762055Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":46,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:57:21.997909Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-05T10:30:59.155257Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-10T22:06:36.928052Z","title":"Llama guard 3 vision: Safe- guarding human-ai image understanding conversations.arXiv preprint arXiv:2411.10414,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.03292","last_updated":"2025-01-06T08:36:28Z","snapshot_observed_at":"2026-08-18T20:44:11.160000Z","submitted_at":"2025-01-06T08:36:28Z","title":"Multi-Modal One-Shot Federated Ensemble Learning for Medical Data with Vision Large Language Model","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T22:06:36.928052Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2501.03292"},"observation_digest":"sha256:2048f60b961653bb02d40634882da791de4912a3f573e6ca03eb6c95f09a2ad6","observation_id":"5338327d-43fd-40c9-89ac-0a9e9e809fe0","resolution":{"observed_at":"2026-08-10T22:06:36.928052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-10T19:27:42.201183Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10057","last_updated":"2025-01-17T09:22:35Z","snapshot_observed_at":"2026-08-21T02:31:48.030559Z","submitted_at":"2025-01-17T09:22:35Z","title":"MSTS: A Multimodal Safety Test Suite for Vision-Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T19:27:42.201183Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2501.10057"},"observation_digest":"sha256:7de20d5bc24c49d820e8c3471aea8752f21ec903462b44302b8558bb750f212a","observation_id":"045b3ac9-2178-4ca6-8ec9-7f65a19bd5e8","resolution":{"observed_at":"2026-08-10T19:27:42.201183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2502.01241","last_updated":"2026-04-13T12:56:05Z","snapshot_observed_at":"2026-08-14T13:12:40.356279Z","submitted_at":"2025-02-03T11:02:30Z","title":"Peering Behind the Shield: Guardrail Identification in Large Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-23T03:45:14.234545Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2502.01241"},"observation_digest":"sha256:170ef39451ca6a04893b6e03a7da56941b20fa9563afca97235e3919f6e63b0e","observation_id":"05d35bdc-b54e-454b-88a1-c0052816a186","resolution":{"observed_at":"2026-05-23T03:45:21.411682Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-09T12:47:21.635346Z","title":"D., Upasani, K., and Pasupuleti, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02260","last_updated":"2026-06-02T17:48:48Z","snapshot_observed_at":"2026-08-18T21:16:36.251781Z","submitted_at":"2025-02-04T12:17:08Z","title":"Position: Adversarial ML for LLMs Is Not Making Any Progress","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T12:47:21.635346Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2502.02260"},"observation_digest":"sha256:7348b0684009b0c76c367ae9ce88be7e8f12989528e70544a4722c6a0f20d11e","observation_id":"2a14a196-5cd8-4644-8dd6-9f5f866d8dca","resolution":{"observed_at":"2026-08-09T12:47:21.635346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-08T11:17:01.558974Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07987","last_updated":"2025-06-04T18:10:51Z","snapshot_observed_at":"2026-08-17T22:10:06.948727Z","submitted_at":"2025-02-11T22:07:47Z","title":"Universal Adversarial Attack on Aligned Multimodal LLMs","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T11:17:01.558974Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2502.07987"},"observation_digest":"sha256:29df35304fbf6152d20bebcef7de15e3c3f912e811b846bc5dc6ed1bce72013a","observation_id":"17d1a7cf-e579-4cbb-b1dd-91f41bbf9764","resolution":{"observed_at":"2026-08-08T11:17:01.558974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2503.03480","last_updated":"2026-04-19T06:23:17Z","snapshot_observed_at":"2026-08-17T00:52:22.037468Z","submitted_at":"2025-03-05T13:16:55Z","title":"SafeVLA: Towards Safety Alignment of Vision-Language-Action Model via Constrained Learning","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-23T01:27:33.123243Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2503.03480"},"observation_digest":"sha256:4a486930b888ed6638b0065675b9d27f605ef8ca111df2e5571e65810000a22d","observation_id":"44c9e5cf-e35a-4b7c-abc1-e398f7346f65","resolution":{"observed_at":"2026-05-23T01:32:22.636141Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-16T10:57:21.997909Z","title":"Llama guard 3 vision: Safeguarding human-ai image understanding conversations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16907","last_updated":"2025-07-25T21:03:17Z","snapshot_observed_at":"2026-08-19T22:38:40.467335Z","submitted_at":"2025-04-23T17:34:48Z","title":"BadVideo: Stealthy Backdoor Attack against Text-to-Video Generation","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T10:57:21.997909Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2504.16907"},"observation_digest":"sha256:72498253eb3fa276754a937a5e3c5f149fc3e69c993b00ca4c443fd59de5b571","observation_id":"c5d15393-8b69-4e68-8c9a-12494ca33dbf","resolution":{"observed_at":"2026-08-16T10:57:21.997909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-16T10:36:48.079314Z","title":"Jianfeng Chi, Ujjwal Karn, Hongyuan Zhan, Eric Smith, Javier Rando, Yiming Zhang, Kate Plawiak, Zacharie Delpierre Coudert, Kartikeya Upasani, and Mahesh Pasupuleti","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17704","last_updated":"2025-05-24T12:50:56Z","snapshot_observed_at":"2026-08-19T22:04:02.585395Z","submitted_at":"2025-04-24T16:11:01Z","title":"Safety in Large Reasoning Models: A Survey","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-16T10:36:48.079314Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2504.17704"},"observation_digest":"sha256:1c7fa3c6d5ca2956ed4d650e8297e10fd864292177daa21437d7a6472bfb5eb3","observation_id":"0605da23-8e2d-469d-88f9-c43235685d5f","resolution":{"observed_at":"2026-08-16T10:36:48.079314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-15T21:05:17.326452Z","title":"Llama guard 3 vision: Safeguarding human-ai image understanding conversations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11049","last_updated":"2025-05-16T09:46:10Z","snapshot_observed_at":"2026-08-19T06:35:44.026799Z","submitted_at":"2025-05-16T09:46:10Z","title":"GuardReasoner-VL: Safeguarding VLMs via Reinforced Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:05:17.326452Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2505.11049"},"observation_digest":"sha256:44e254bfb98cb6373bc03a49003618ac86783163e567dd6ae72f3d3c5c08fc59","observation_id":"a9a5519a-a09f-454e-9774-509c90d902ec","resolution":{"observed_at":"2026-08-15T21:05:17.326452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-15T20:41:10.476101Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12368","last_updated":"2025-06-17T05:38:20Z","snapshot_observed_at":"2026-08-19T22:06:02.411075Z","submitted_at":"2025-05-18T11:14:14Z","title":"CAPTURE: Context-Aware Prompt Injection Testing and Robustness Enhancement","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T20:41:10.476101Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2505.12368"},"observation_digest":"sha256:19ca161cde1cd8fb9a2f5017efe8bc597ec3004e4e57ad2fa1111eb8c69e498e","observation_id":"7c328271-341b-45e1-a14a-2386493b51e1","resolution":{"observed_at":"2026-08-15T20:41:10.476101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-07T15:43:21.902482Z","title":"Upasani, and Mahesh Pa- supuleti","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14035","last_updated":"2025-05-20T07:31:17Z","snapshot_observed_at":"2026-08-20T18:08:58.552890Z","submitted_at":"2025-05-20T07:31:17Z","title":"ShieldVLM: Safeguarding the Multimodal Implicit Toxicity via Deliberative Reasoning with LVLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:21.902482Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2505.14035"},"observation_digest":"sha256:117ec0863261569dd0310c2a63a04435240b924fd6e7d1002fdf53139f15e7fc","observation_id":"44af8039-f98a-4ca2-9be4-5c51c6071f3a","resolution":{"observed_at":"2026-08-07T15:43:21.902482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-07T15:03:39.673608Z","title":"Llama guard 3 vision: Safeguarding human-ai image understanding conversations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-13T20:07:08.640609Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:39.673608Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:3912892ec94b30dae524dd21820f012710a3daf8ecc6aa925f6af8c6b090d3af","observation_id":"f02ef074-c473-4d5e-9bbc-0e4a8128692e","resolution":{"observed_at":"2026-08-07T15:03:39.673608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-07T14:27:03.421477Z","title":"Llama guard 3vision:Safeguardinghuman-aiimageunderstandingconversations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18889","last_updated":"2025-08-24T03:15:13Z","snapshot_observed_at":"2026-08-18T03:59:36.764795Z","submitted_at":"2025-05-24T22:22:43Z","title":"Security Concerns for Large Language Models: A Survey","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:03.421477Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2505.18889"},"observation_digest":"sha256:46f387448052aaf152bb0105c496e63291a6be5de2c15d73225bfaaf4fb1224d","observation_id":"48eb96e2-9bbc-4668-9c72-6313023d7d9b","resolution":{"observed_at":"2026-08-07T14:27:03.421477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-07T11:04:05.820412Z","title":"Llama guard 3 vision: Safeguarding human-ai image understanding conversations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03614","last_updated":"2025-06-04T06:46:06Z","snapshot_observed_at":"2026-08-15T09:53:57.589178Z","submitted_at":"2025-06-04T06:46:06Z","title":"VLMs Can Aggregate Scattered Training Patches","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:05.820412Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2506.03614"},"observation_digest":"sha256:f6c5409bcc93b0c6ac735ed5b4f059b60c237b5a87ec8f8abcd4c78be176fb17","observation_id":"b4f196d9-71c2-43b6-9217-26debf298a97","resolution":{"observed_at":"2026-08-07T11:04:05.820412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-07T13:17:51.324825Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05368","last_updated":"2025-05-28T09:13:41Z","snapshot_observed_at":"2026-08-22T16:15:51.495790Z","submitted_at":"2025-05-28T09:13:41Z","title":"Speaking images. A novel framework for the automated self-description of artworks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:51.324825Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2506.05368"},"observation_digest":"sha256:e7fcaff079854b1e278fabbe69987790a59df6b7821e61731c7e73b7093ce832","observation_id":"9548bc3d-60a6-4042-a178-b1c18432db6a","resolution":{"observed_at":"2026-08-07T13:17:51.324825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-06T16:12:47.921568Z","title":"Llama guard 3 vision: Safeguarding human-ai image understanding conversations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14293","last_updated":"2025-07-18T18:06:27Z","snapshot_observed_at":"2026-08-20T02:31:40.859214Z","submitted_at":"2025-07-18T18:06:27Z","title":"WebGuard: Building a Generalizable Guardrail for Web Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:47.921568Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2507.14293"},"observation_digest":"sha256:f7b1f75dbfaf6a1c977e9fe96b78e395d74b42f998727e2114042ba0e3ffdc21","observation_id":"e8ec850e-642c-49aa-9266-b79e0230029d","resolution":{"observed_at":"2026-08-06T16:12:47.921568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-06T13:05:30.941258Z","title":"Llama guard 3 vision: Safeguarding human-ai image understanding conversations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21206","last_updated":"2025-07-28T17:58:12Z","snapshot_observed_at":"2026-08-14T13:44:31.305337Z","submitted_at":"2025-07-28T17:58:12Z","title":"Agentic Web: Weaving the Next Web with AI Agents","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T13:05:30.941258Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2507.21206"},"observation_digest":"sha256:5ff8c2f03c329ee580d13174901c845f9be796807488e22c79df64ff2e6ed13f","observation_id":"335ee4fe-56fb-4146-923f-8bbbfdab16c3","resolution":{"observed_at":"2026-08-06T13:05:30.941258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-06T12:09:39.630560Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-15T03:46:38.153906Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.630560Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:378744bcfafd081d017c1f22617b22ef9716f53f5968ab358d18929f930e71a4","observation_id":"9cb7fc64-0366-4d19-ab69-4a448b819912","resolution":{"observed_at":"2026-08-06T12:09:39.630560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-05T10:39:08.237034Z","title":"Llama guard 3 vision: Safeguarding human-ai image understanding conversations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03871","last_updated":"2025-09-04T04:12:31Z","snapshot_observed_at":"2026-08-17T17:37:38.616375Z","submitted_at":"2025-09-04T04:12:31Z","title":"A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models","version":1},"reference_index":271,"source":"pdf_text","source_observed_at":"2026-08-05T10:39:08.237034Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2509.03871"},"observation_digest":"sha256:869d5427588b8fd2a92548d60bda2cbbe623eb5f0362b24119e21737f94dd08f","observation_id":"5e27679b-e4c7-415d-9938-5bb015d069a4","resolution":{"observed_at":"2026-08-05T10:39:08.237034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-04T10:22:04.265393Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.10271","last_updated":"2026-06-26T00:42:37Z","snapshot_observed_at":"2026-08-19T09:35:20.441231Z","submitted_at":"2025-10-11T16:14:56Z","title":"MetaBreak: Jailbreaking Online LLM Services via Special Token Manipulation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T10:22:04.265393Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2510.10271"},"observation_digest":"sha256:c134cc3bc0a4210a9bf0267d774109fa0972fa8b0965028f9305ecc8e85c6ba1","observation_id":"a441a9e7-6922-4492-8447-1f81cf1845f1","resolution":{"observed_at":"2026-08-04T10:22:04.265393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-04T06:54:13.642986Z","title":"Llama Guard 3 Vision: Safeguarding human–ai image understanding conversations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.00382","last_updated":"2026-08-03T16:22:30Z","snapshot_observed_at":"2026-08-13T23:55:51.184827Z","submitted_at":"2025-11-01T03:29:56Z","title":"Efficiency vs. Alignment: Investigating Safety and Fairness Risks in Parameter-Efficient Fine-Tuning of LLMs","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-04T06:54:13.642986Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2511.00382"},"observation_digest":"sha256:e7b17ee125cab5774daa29eb402b4ccfade44d3d70cb08c5579b5c5b09d326fa","observation_id":"7d96b9a3-9a7c-4e5f-ab71-fc09da28f6ae","resolution":{"observed_at":"2026-08-04T06:54:13.642986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2512.12069","last_updated":"2026-04-20T07:36:16Z","snapshot_observed_at":"2026-08-11T09:56:37.609830Z","submitted_at":"2025-12-12T22:31:38Z","title":"Rethinking Jailbreak Detection of Large Vision Language Models with Representational Contrastive Scoring","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T22:28:41.134253Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2512.12069"},"observation_digest":"sha256:65f4c1dec95d17d526ce4f36ea67b077e032c183750db21881fce0a0b23075bc","observation_id":"bcab73ec-16b2-4f58-881a-a1cabb3d1221","resolution":{"observed_at":"2026-05-16T22:31:19.456225Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-02T23:16:36.535613Z","title":"D., Upasani, K., and Pa- supuleti, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14399","last_updated":"2026-05-28T04:31:34Z","snapshot_observed_at":"2026-08-17T11:24:02.533527Z","submitted_at":"2026-02-16T02:15:58Z","title":"Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T23:16:36.535613Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2602.14399"},"observation_digest":"sha256:a4886694002f309a986f18c79b13187767444ca996122d4cc6e06d595886feb9","observation_id":"9b244e70-b932-4792-b083-a976e5b4c038","resolution":{"observed_at":"2026-08-02T23:16:36.535613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2603.27112","last_updated":"2026-04-23T14:57:50Z","snapshot_observed_at":"2026-08-14T10:39:07.836038Z","submitted_at":"2026-03-28T03:41:40Z","title":"RailVQA: A Benchmark and Framework for Efficient Interpretable Visual Cognition in Automatic Train Operation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-14T22:24:13.897439Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2603.27112"},"observation_digest":"sha256:17f2dabec2b3f0cdfc6d4a914ba2fe4431aa4067284f03752967e392b5d0282f","observation_id":"52430498-5737-4640-81de-ad8fcdc47690","resolution":{"observed_at":"2026-05-14T22:28:04.833354Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2604.08846","last_updated":"2026-04-10T01:01:56Z","snapshot_observed_at":"2026-08-13T19:19:16.724751Z","submitted_at":"2026-04-10T01:01:56Z","title":"Dictionary-Aligned Concept Control for Safeguarding Multimodal LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T18:04:05.157103Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2604.08846"},"observation_digest":"sha256:0d9371d9233f2ee8bffca5cee855236a1b1303b7507c0d9fe8184eae8519a7a7","observation_id":"a990da7c-ce50-4c1e-8864-67a0f1e2d993","resolution":{"observed_at":"2026-05-11T05:35:57.757351Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2604.17053","last_updated":"2026-04-18T16:22:25Z","snapshot_observed_at":"2026-08-13T07:20:59.949241Z","submitted_at":"2026-04-18T16:22:25Z","title":"Jailbreaking Large Language Models with Morality Attacks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T06:17:14.242224Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2604.17053"},"observation_digest":"sha256:721bebf76150fb6047cfd405b42dfd0956f955018a4b665ef1fc44b756e7882b","observation_id":"2f0a120d-992e-4529-b1ad-1ecd235e2b10","resolution":{"observed_at":"2026-05-10T06:21:27.025753Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2604.18847","last_updated":"2026-05-28T03:46:47Z","snapshot_observed_at":"2026-08-11T18:23:14.786050Z","submitted_at":"2026-04-20T21:12:40Z","title":"Human-Guided Harm Recovery for Computer Use Agents","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-10T04:12:02.341064Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2604.18847"},"observation_digest":"sha256:e75c50bececb9d038193a9e9078cb3cfa0fe10caf5206222c1745a99cc1f0b9c","observation_id":"b829f9bb-64fd-49d5-ac99-66371fee3ea5","resolution":{"observed_at":"2026-05-11T12:06:02.872694Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2604.18847","last_updated":"2026-05-28T03:46:47Z","snapshot_observed_at":"2026-08-11T18:23:14.786050Z","submitted_at":"2026-04-20T21:12:40Z","title":"Human-Guided Harm Recovery for Computer Use Agents","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-05T10:22:55.676716Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2604.18847"},"observation_digest":"sha256:71c26dcf6689e95730b209fc81d302af68a2f9a5b4b7f0c5bfe80f7eb9ccc65c","observation_id":"6a392a02-df60-413f-a342-aa6f3fbdf70f","resolution":{"observed_at":"2026-07-05T10:30:59.156865Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2605.04785","last_updated":"2026-05-06T11:38:16Z","snapshot_observed_at":"2026-08-16T05:31:35.972554Z","submitted_at":"2026-05-06T11:38:16Z","title":"AgentTrust: Runtime Safety Evaluation and Interception for AI Agent Tool Use","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T17:34:11.020584Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2605.04785"},"observation_digest":"sha256:4dcd4a944bb4277bf6cea9f094f163c67f8e6aaff220a243b819e2357f6b69e4","observation_id":"efd652ae-1ba5-4907-97c9-2f8f71ce815d","resolution":{"observed_at":"2026-05-11T17:26:07.011087Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2605.15030","last_updated":"2026-05-14T16:26:27Z","snapshot_observed_at":"2026-08-13T15:20:39.475290Z","submitted_at":"2026-05-14T16:26:27Z","title":"WARD: Adversarially Robust Defense of Web Agents Against Prompt Injections","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T20:16:13.413064Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2605.15030"},"observation_digest":"sha256:7d4d6486fbfa58b4430e4937b505d3fc41209faff4b6ddafbea2980252323a38","observation_id":"e2eb4062-4846-415d-b99b-9e7690c21da3","resolution":{"observed_at":"2026-07-01T14:45:49.563695Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2605.17610","last_updated":"2026-05-17T19:10:36Z","snapshot_observed_at":"2026-08-15T19:45:38.563076Z","submitted_at":"2026-05-17T19:10:36Z","title":"SafeLens: Deliberate and Efficient Video Guardrails with Fast-and-Slow Screening","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T14:03:56.859481Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2605.17610"},"observation_digest":"sha256:6760739b9c7cfe0af4ad38cc418463b1f18f778e5d20445521994f4f2858028e","observation_id":"16f5f3fa-ce5c-4411-a7b3-11bf12a0c391","resolution":{"observed_at":"2026-05-20T14:08:21.196129Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2605.18915","last_updated":"2026-05-18T03:23:58Z","snapshot_observed_at":"2026-08-16T05:38:57.908803Z","submitted_at":"2026-05-18T03:23:58Z","title":"DMN: A Compositional Framework for Jailbreaking Multimodal LLMs with Multi-Image Inputs","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-20T10:19:11.536555Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2605.18915"},"observation_digest":"sha256:4d804b196d5f9a7d207b2712b466973beda26e8573079dcb1355a6119cca7af3","observation_id":"6b7f2b4c-9b57-4904-94dd-a40f890aade3","resolution":{"observed_at":"2026-05-20T10:23:12.307541Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2606.01837","last_updated":"2026-06-01T07:49:12Z","snapshot_observed_at":"2026-08-15T05:40:08.065854Z","submitted_at":"2026-06-01T07:49:12Z","title":"Benign Inputs, Harmful Outputs: Cross-Modal Jailbreaking via Distributed Semantic Recomposition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T14:17:52.902183Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2606.01837"},"observation_digest":"sha256:6fc411e24b1d9ae238a79a6dd2a62d03fc1916d72629248a600584f20802bf4b","observation_id":"c42f1064-0c71-4f50-a029-964350980e60","resolution":{"observed_at":"2026-07-01T23:26:23.274369Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-19T23:22:39.431228Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:6e23030fc0c17502f3efc4ba7592f8aa0f76baab2fd2552a38036b25e30b2ed3","observation_id":"143b6443-0812-475e-9e1a-27cdbd5ddecb","resolution":{"observed_at":"2026-07-01T22:56:20.691442Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2606.09700","last_updated":"2026-06-19T20:34:30Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T16:21:34Z","title":"What the Eyes See, the LLMs Miss: Exploiting Human Perception for Adversarial Text Attacks","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T16:18:01.850874Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2606.09700"},"observation_digest":"sha256:01746b1e2f663b7412c602ed5d2fd702489c33aba4b26bd6faafc063327b6653","observation_id":"a5cf95bf-4101-4784-a745-27f5f4d0c2ae","resolution":{"observed_at":"2026-07-03T01:47:31.661848Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:27.948225Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:1c15339f359b01ddd62e8c16e1256a9b30b352e25cb0b7a124fb9c636ae48bdf","observation_id":"2bc847a2-3b2d-4df4-aa9b-7dc56b2851fd","resolution":{"observed_at":"2026-07-04T16:59:58.594811Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:17012b100e9b5687c985ff93ef59fbe0121f984b4715def40b9289e5fc969372","observation_id":"ff2f73ca-308d-418c-ae66-c60c96ede16f","resolution":{"observed_at":"2026-06-29T18:03:48.788821Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2606.26199","last_updated":"2026-06-26T02:47:28Z","snapshot_observed_at":"2026-08-21T16:05:08.170290Z","submitted_at":"2026-06-24T16:23:10Z","title":"MIRAGE: Protecting against Malicious Image Editing via False Moderation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T01:52:12.291420Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2606.26199"},"observation_digest":"sha256:dd7ac47998e7125b6c825982a0f1a259d29e0a9fc56733ec935746924de3b806","observation_id":"65a76c93-d42c-4124-aba2-602a70478aa8","resolution":{"observed_at":"2026-07-04T15:09:54.627654Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2606.26199","last_updated":"2026-06-26T02:47:28Z","snapshot_observed_at":"2026-08-21T16:05:08.170290Z","submitted_at":"2026-06-24T16:23:10Z","title":"MIRAGE: Protecting against Malicious Image Editing via False Moderation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T04:46:56.552601Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2606.26199"},"observation_digest":"sha256:b5a6634482ae3ea640cdd10246b60fb7fb3f54de2aa11fcc32cff2b3c08af15a","observation_id":"610da550-8323-46f7-8fef-da5744b63825","resolution":{"observed_at":"2026-06-29T19:13:53.525339Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2606.28153","last_updated":"2026-06-29T15:00:34Z","snapshot_observed_at":"2026-08-14T21:18:47.124582Z","submitted_at":"2026-06-26T14:51:16Z","title":"Robust Harmful Features Under Jailbreak Attacks: Mechanistic Evidence from Attention Head Specialization in Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-29T03:35:34.594617Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2606.28153"},"observation_digest":"sha256:dac91b8fa7d6f116323dee5dddefc0f5ce62a9fd0390f88734d1ae39757cbc1d","observation_id":"9345b635-596c-4853-aaa8-959e7a2ecb4c","resolution":{"observed_at":"2026-07-01T17:35:51.359552Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-01T23:03:12.035774Z","title":"Llama guard 3 vision: Safeguarding human-ai image understanding conversations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15550","last_updated":"2026-07-17T01:45:54Z","snapshot_observed_at":"2026-08-16T23:32:16.917248Z","submitted_at":"2026-07-17T01:45:54Z","title":"SeerGuard: A Safety Framework for Mobile GUI Agents via World Model Prediction","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T23:03:12.035774Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2607.15550"},"observation_digest":"sha256:9a6e1111da38985f2a6c209586239ad2fa65c5f125b2ce269b3d5b920727facd","observation_id":"28875ef5-b675-4f81-9168-b8f8c73da195","resolution":{"observed_at":"2026-08-01T23:03:12.035774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-01T07:36:56.205558Z","title":"Dai,J.;etal.2023.SafeRLHF:SafeReinforcementLearning from Human Feedback.arXiv preprint arXiv:2310.12773","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21401","last_updated":"2026-07-23T15:02:24Z","snapshot_observed_at":"2026-08-17T19:38:21.420802Z","submitted_at":"2026-07-23T15:02:24Z","title":"When Are Reasoning-Based Guardrails Not Efficient? ResponseGuard: A Fast Vision-Language Guard for Real-Time Moderation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T07:36:56.205558Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2607.21401"},"observation_digest":"sha256:e2c427f6a1ee853e5a247615fee6c92452c5c7ffdae99b6e51a722cbecc2aafc","observation_id":"88504edd-9fff-482e-ba81-12a809bf8798","resolution":{"observed_at":"2026-08-01T07:36:56.205558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-31T09:24:20.410283Z","title":"D., Upasani, K., and Pasupuleti, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24898","last_updated":"2026-07-27T16:42:36Z","snapshot_observed_at":"2026-08-15T08:02:42.558488Z","submitted_at":"2026-07-27T16:42:36Z","title":"Harm is not Universal: Community-Specific Toxicity Detection is Urgently Needed","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-31T09:24:20.410283Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2607.24898"},"observation_digest":"sha256:fb9a69025a700be7197c0fe39c3adcebc0d4473614c640fb6c0da065a4b952d5","observation_id":"11c983ec-144d-4b6a-a90e-7ba8182ad791","resolution":{"observed_at":"2026-07-31T09:24:20.410283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-06T00:20:22.240423Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01373","last_updated":"2026-08-02T16:49:25Z","snapshot_observed_at":"2026-08-20T03:56:44.660192Z","submitted_at":"2026-08-02T16:49:25Z","title":"The Boy Who Cried Wolf: Adversarial Misclassification of Safe Inputs as Unsafe in Multimodal Guardrails","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:20:22.240423Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2608.01373"},"observation_digest":"sha256:e8b5b44bc9f3efdc11c3e216bc30818d4950aed13dea52b1986ccc3b5b919de8","observation_id":"27324d3e-51bd-489e-8c99-24bf9002c4bf","resolution":{"observed_at":"2026-08-06T00:20:22.240423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-07T21:24:14.998324Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05909","last_updated":"2026-08-06T11:39:08Z","snapshot_observed_at":"2026-08-15T02:16:30.151652Z","submitted_at":"2026-08-06T11:39:08Z","title":"MMAligner: Safeguarding Multimodal Large Language Models through Representation Calibration","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T21:24:14.998324Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2608.05909"},"observation_digest":"sha256:5e9756296ba0d8e53432d0443a5575f64c3f9521b4735d6ec4730bc66d744774","observation_id":"ee6d2054-32cc-419f-8e86-cdc0571d642c","resolution":{"observed_at":"2026-08-07T21:24:14.998324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-14T04:34:05.661690Z","title":"D.; Upasani, K.; and Pasupuleti, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08641","last_updated":"2026-08-09T11:19:30Z","snapshot_observed_at":"2026-08-16T12:37:25.954512Z","submitted_at":"2026-08-09T11:19:30Z","title":"Whose Refusal Is It? The Unmeasured Contribution of Black-Box Multimodal Guardrails","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-14T04:34:05.661690Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2608.08641"},"observation_digest":"sha256:4b897dc6e99311ce51f529f7a2f544399c0ec503a0e7f8ecd34b07f54d1a8eaa","observation_id":"b1c98a0a-cdef-483a-947a-b337ca954661","resolution":{"observed_at":"2026-08-14T04:34:05.661690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.10414/citation-record","integrity":"/paper/2411.10414/integrity","json":"/paper/2411.10414/citation-record.json","paper":"/paper/2411.10414"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T19:41:19.611726Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.611726Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:7a7960d59f2b35cc24b8080567cc4415ab83caae2cf5cbed1da2906ef5d6ff26","observation_id":"6bab6ff7-5926-4b4a-931b-4b97a1572bde","resolution":{"observed_at":"2026-08-12T19:41:19.611726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.06083","last_updated":"2019-09-04T18:53:10Z","snapshot_observed_at":"2026-08-07T14:27:46.872660Z","submitted_at":"2017-06-19T17:53:11Z","title":"Towards Deep Learning Models Resistant to Adversarial Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.06083","snapshot_observed_at":"2026-08-12T19:41:19.687727Z","title":"Aleksander Madry","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.687727Z"},"links":{"cited_paper":"/paper/1706.06083","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:934135b9ebca2a590ca65964fa2b1d147350c1562b94eb179ff8706c619f7135","observation_id":"608c4cba-45bf-4837-a607-e7ac619bfe0a","resolution":{"observed_at":"2026-08-12T19:41:19.687727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-08-20T18:27:04.837880Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-12T19:41:19.642602Z","title":"Gemini: a family of highly capable multimodal models.arXiv preprint arXiv:2312.11805,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.642602Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:16815474f889455fe1298afe01858d06debaf6c70fb5c04df3dd3a3f09feb881","observation_id":"377965bc-55ef-4702-9e68-a9625ed67278","resolution":{"observed_at":"2026-08-12T19:41:19.642602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-08-14T15:42:19.849118Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-12T19:41:19.652833Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.652833Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:b9228541057d1733769f22f290f46b746eb03c66dcff91f33e5bc298fa9ee804","observation_id":"f7cc4230-c587-4dda-85db-f9c61cff8da6","resolution":{"observed_at":"2026-08-12T19:41:19.652833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-12T19:41:19.659949Z","title":"Baseline defenses for adversarial attacks against aligned language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.659949Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:e63bb661ca46826e963c08725bf0c94453bf9aceca5ad579aef54a7d120c9d44","observation_id":"d8fa95f1-97ae-466a-a75f-73f812f06eb3","resolution":{"observed_at":"2026-08-12T19:41:19.659949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-12T19:41:19.664516Z","title":"Scaling laws for neural language models.arXiv preprint arXiv:2001.08361,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.664516Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:9165ddd220ce5807b504f5f02906e5f0e2e191903d8a1bc9af21334163a2f7ed","observation_id":"f5755abd-8543-4dfc-bb2a-6a97c54cc95f","resolution":{"observed_at":"2026-08-12T19:41:19.664516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:41:19.672236Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.672236Z"},"links":{"citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:a06ef162e40e9b1c57a439102db4b4741b828e76e61ec5b939d9fc6b10d2cc7f","observation_id":"e9c447c6-1fb2-46e7-bdd0-1030180f30e4","resolution":{"observed_at":"2026-08-12T19:41:19.672236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-12T19:41:19.677557Z","title":"The llama 3 herd of models, 2024a.https://arxiv.org/abs/2407.21783","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.677557Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:6993ee6bd841059e94aa8251b6bb29e66f269237977e617c3f533b3f2af2d38f","observation_id":"125e3ad4-7929-4c1d-86c2-fdfcd50d61e0","resolution":{"observed_at":"2026-08-12T19:41:19.677557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05946","last_updated":"2024-06-10T00:35:23Z","snapshot_observed_at":"2026-08-18T11:01:42.927110Z","submitted_at":"2024-06-10T00:35:23Z","title":"Safety Alignment Should Be Made More Than Just a Few Tokens Deep","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05946","snapshot_observed_at":"2026-08-12T19:41:19.707975Z","title":"Safety alignment should be made more than just a few tokens deep.arXiv preprint arXiv:2406.05946,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.707975Z"},"links":{"cited_paper":"/paper/2406.05946","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:0e73d4502e42098e801000b22a4fc5015179436eb46fb3574f365241d9a18d22","observation_id":"6b50efe8-27bb-4f7e-ab22-8957671db108","resolution":{"observed_at":"2026-08-12T19:41:19.707975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03489","last_updated":"2024-10-23T13:38:29Z","snapshot_observed_at":"2026-08-16T13:12:33.441897Z","submitted_at":"2024-10-04T14:59:39Z","title":"Gradient-based Jailbreak Images for Multimodal Fusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03489","snapshot_observed_at":"2026-08-12T19:41:19.713071Z","title":"Gradient-based jailbreak images for multimodal fusion models.arXiv preprint arXiv:2410.03489,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.713071Z"},"links":{"cited_paper":"/paper/2410.03489","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:0d84e8d199bcde30228c0b322833921a5e8c747a9c9f52c56775bda69985e9dd","observation_id":"48db200e-9897-465d-b0c7-da738f48eb32","resolution":{"observed_at":"2026-08-12T19:41:19.713071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6199","last_updated":"2014-02-19T16:33:14Z","snapshot_observed_at":"2026-08-15T16:41:15.505782Z","submitted_at":"2013-12-21T03:36:08Z","title":"Intriguing properties of neural networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6199","snapshot_observed_at":"2026-08-12T19:41:19.717986Z","title":"Intriguing properties of neural networks.arXiv preprint arXiv:1312.6199,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.717986Z"},"links":{"cited_paper":"/paper/1312.6199","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:6682788bda9dfc53760bb67a163d99fe862d90851a00bdafdd6537920139a145","observation_id":"745cbf86-2fd6-47cd-a8a2-7d0b5bb25443","resolution":{"observed_at":"2026-08-12T19:41:19.717986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01652","last_updated":"2022-02-08T20:26:45Z","snapshot_observed_at":"2026-08-14T06:11:14.515796Z","submitted_at":"2021-09-03T17:55:52Z","title":"Finetuned Language Models Are Zero-Shot Learners","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.01652","snapshot_observed_at":"2026-08-12T19:41:19.728380Z","title":"Finetuned language models are zero-shot learners.arXiv preprint arXiv:2109.01652,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.728380Z"},"links":{"cited_paper":"/paper/2109.01652","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:c8ed48f2e165763a237d21e0c5363ba5b154f6c8c378c28ccc256095a686ce4c","observation_id":"3930a099-e5d5-404a-9520-7631263bbbaa","resolution":{"observed_at":"2026-08-12T19:41:19.728380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13031","last_updated":"2024-07-23T22:56:13Z","snapshot_observed_at":"2026-08-20T02:52:47.433585Z","submitted_at":"2024-03-19T07:25:02Z","title":"RigorLLM: Resilient Guardrails for Large Language Models against Undesired Content","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13031","snapshot_observed_at":"2026-08-12T19:41:19.734437Z","title":"Rigorllm: Resilient guardrails for large language models against undesired content.arXiv preprint arXiv:2403.13031,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.734437Z"},"links":{"cited_paper":"/paper/2403.13031","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:3299f26359ed2d0fd5ad8fec6e415f7b118a3a5a466c21484b5fb8625c0049f5","observation_id":"5897041d-e12e-47d8-ab0c-e928252a4a8b","resolution":{"observed_at":"2026-08-12T19:41:19.734437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21772","last_updated":"2024-08-04T22:13:39Z","snapshot_observed_at":"2026-08-19T02:59:43.798238Z","submitted_at":"2024-07-31T17:48:14Z","title":"ShieldGemma: Generative AI Content Moderation Based on Gemma","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21772","snapshot_observed_at":"2026-08-12T19:41:19.739329Z","title":"Shieldgemma: Generative ai content moderation based on gemma","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.739329Z"},"links":{"cited_paper":"/paper/2407.21772","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:8fd4a8a25642fee9a7f1939e158c637cad766033a3b8b5679cc957cdad8dedf8","observation_id":"7f2c60b6-d6f0-4d16-8b8d-8c8fb8bc85f4","resolution":{"observed_at":"2026-08-12T19:41:19.739329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14586","last_updated":"2024-09-22T20:28:40Z","snapshot_observed_at":"2026-08-21T17:27:02.971927Z","submitted_at":"2024-09-22T20:28:40Z","title":"Backtracking Improves Generation Safety","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14586","snapshot_observed_at":"2026-08-12T19:41:19.745065Z","title":"Backtracking improves generation safety.arXiv preprint arXiv:2409.14586,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.745065Z"},"links":{"cited_paper":"/paper/2409.14586","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:7b16f833397bdcdbe7719e23b6a430c712156b225565ae92965b9ab87388e9db","observation_id":"15272f1c-e302-4d92-8a5b-8337b0449037","resolution":{"observed_at":"2026-08-12T19:41:19.745065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-12T19:41:19.749549Z","title":"Universal and transferable adversarial attacks on aligned language models.arXiv preprint arXiv:2307.15043,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.749549Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:e6f7c628ef6138e50394c336db55344d5a65d663a83570ecdf835ebf72a43ca4","observation_id":"c9f6a650-6426-4ba0-b89d-53c5743a2b00","resolution":{"observed_at":"2026-08-12T19:41:19.749549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04313","last_updated":"2024-07-12T16:51:07Z","snapshot_observed_at":"2026-08-19T15:15:09.617421Z","submitted_at":"2024-06-06T17:57:04Z","title":"Improving Alignment and Robustness with Circuit Breakers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04313","snapshot_observed_at":"2026-08-12T19:41:19.754273Z","title":"Improving alignment and robustness with short circuiting.arXiv preprint arXiv:2406.04313,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.754273Z"},"links":{"cited_paper":"/paper/2406.04313","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:13c4cf7a633a4d68c10859c025d603cb3197c5f5aa1f665131218bd944da96f2","observation_id":"7ad0d0f3-61ab-445f-8491-9baacbcb1902","resolution":{"observed_at":"2026-08-12T19:41:19.754273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:41:20.208964Z","title":null,"venue":null,"work_id":"9d73db34-bfe5-46ee-85bc-41bf6699a355","year":2017},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.762055Z"},"links":{"citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:1aaaf9b601a641147d71ba305de85bfd3039e119501220e6f89c6c96f383106f","observation_id":"c1caace8-2616-44f7-b1e2-54cad6bb6cc1","resolution":{"observed_at":"2026-08-12T19:41:20.214718Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09932","last_updated":"2024-09-06T00:46:40Z","snapshot_observed_at":"2026-08-18T08:23:26.325897Z","submitted_at":"2024-04-15T16:58:28Z","title":"Foundational Challenges in Assuring Alignment and Safety of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09932","snapshot_observed_at":"2026-08-12T19:41:19.617548Z","title":"Foundational challenges in assuring alignment and safety of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.617548Z"},"links":{"cited_paper":"/paper/2404.09932","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:b0d1a33d3c02bc3b23e6b719f94191a37d5cc29ff594219213eda370a7f47359","observation_id":"1ffa0eb6-c7c4-4deb-b108-8acbd635c507","resolution":{"observed_at":"2026-08-12T19:41:19.617548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17126","last_updated":"2024-03-11T01:15:09Z","snapshot_observed_at":"2026-08-16T15:29:12.827405Z","submitted_at":"2023-05-26T17:50:11Z","title":"Large Language Models as Tool Makers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17126","snapshot_observed_at":"2026-08-12T19:41:19.631804Z","title":"Large language models as tool makers.arXiv preprint arXiv:2305.17126,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.631804Z"},"links":{"cited_paper":"/paper/2305.17126","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:50f5fee03bb3f0b8e2c3013b1f2d81a8e849d29d5577cc1c1eb8bcc25421a147","observation_id":"7e674f15-d8f5-4090-85e4-8fe37aa6ce21","resolution":{"observed_at":"2026-08-12T19:41:19.631804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:41:20.226162Z","title":"Openai o1 system card, 2024.https://cdn.openai.com/o1-system-card-20240917.pdf","venue":null,"work_id":"d4c4c246-de92-4abc-84af-f48d2ecb6610","year":2024},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.700018Z"},"links":{"citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:204283050128defbd51a4f4b8b99418c3febeca92c20343ea0053375676560e5","observation_id":"27f9e599-9525-4fc0-8061-c155fa652406","resolution":{"observed_at":"2026-08-12T19:41:20.231038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12241","last_updated":"2024-05-13T20:46:10Z","snapshot_observed_at":"2026-08-20T19:31:52.934922Z","submitted_at":"2024-04-18T15:01:00Z","title":"Introducing v0.5 of the AI Safety Benchmark from MLCommons","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12241","snapshot_observed_at":"2026-08-12T19:41:19.723877Z","title":"Introducing v0","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.723877Z"},"links":{"cited_paper":"/paper/2404.12241","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:0c3dcb911c7d0f9dc262229a4f30dcbc5fa6ec6ce2a5a2d2276f5070e341db9a","observation_id":"2749a692-ac32-421c-adb6-d5db5bfe6d8c","resolution":{"observed_at":"2026-08-12T19:41:19.723877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05993","last_updated":"2024-09-11T14:42:29Z","snapshot_observed_at":"2026-08-22T03:42:00.219266Z","submitted_at":"2024-04-09T03:54:28Z","title":"AEGIS: Online Adaptive AI Content Safety Moderation with Ensemble of LLM Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05993","snapshot_observed_at":"2026-08-12T19:41:19.647374Z","title":"Aegis: Online adaptive ai content safety moderation with ensemble of llm experts.arXiv preprint arXiv:2404.05993,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.647374Z"},"links":{"cited_paper":"/paper/2404.05993","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:d2b7eb80ab0d27b721cccd8ecccabfa1ae9e007d9db8f25ccbc41c29012c90a9","observation_id":"f7e03006-52c6-478e-905c-a08392c8e9a7","resolution":{"observed_at":"2026-08-12T19:41:19.647374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-12T19:41:19.623020Z","title":"Language models are few-shot learners.arXiv preprint arXiv:2005.14165,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-12T19:41:19.623020Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2411.10414"},"observation_digest":"sha256:1348d7336f6bfc9ce9d494424daad47dc944ab9fa5fb6bd59a25acf1b84ee48c","observation_id":"2e77e521-acc4-49c4-bd51-d2c7bccfff4c","resolution":{"observed_at":"2026-08-12T19:41:19.623020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 46 inbound Pith citation observations for arXiv:2411.10414."}