{"as_of":"2026-08-19T12:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:990503af20031fad92654bb2580be4258dc91b18f5e5d9322991a804faea39af","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:31:11.314401Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:40:28.678039Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15512","snapshot_observed_at":"2026-08-15T22:40:28.678039Z","title":"T2vshield: Model-agnostic jailbreak defense for text-to-video models.arXiv preprint arXiv:2504.15512, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.06679","last_updated":"2025-06-17T07:44:28Z","snapshot_observed_at":"2026-08-16T05:49:50.988829Z","submitted_at":"2025-05-10T16:04:52Z","title":"T2V-OptJail: Discrete Prompt Optimization for Text-to-Video Jailbreak Attacks","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T22:40:28.678039Z"},"links":{"cited_paper":"/paper/2504.15512","citing_paper":"/paper/2505.06679"},"observation_digest":"sha256:a2741fad282c7b009fb82d5ddaf228e4434123798640e2186423005cee6646ad","observation_id":"aa119bb7-0af4-483d-b601-c4e20854ac88","resolution":{"observed_at":"2026-08-15T22:40:28.678039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15512","snapshot_observed_at":"2026-08-07T15:08:11.529524Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16241","last_updated":"2025-05-26T02:28:07Z","snapshot_observed_at":"2026-08-14T06:52:38.334219Z","submitted_at":"2025-05-22T05:19:42Z","title":"Three Minds, One Legend: Jailbreak Large Reasoning Model with Adaptive Stacked Ciphers","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:08:11.529524Z"},"links":{"cited_paper":"/paper/2504.15512","citing_paper":"/paper/2505.16241"},"observation_digest":"sha256:7ac884b75b7d6bddcb5e7766b73eb7192f50ea7cf1f62255a1b1c55708023463","observation_id":"ab4cf202-2dda-473e-b23a-30f7ef854cac","resolution":{"observed_at":"2026-08-07T15:08:11.529524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15512","snapshot_observed_at":"2026-08-06T21:11:18.384644Z","title":"T2vshield: Model-agnostic jailbreak defense for text-to-video models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-19T11:48:28.811993Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.384644Z"},"links":{"cited_paper":"/paper/2504.15512","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:2c9d033c020639a32a73c6c945fb2a260a42764b43c516c244c9a6f33b0cee5b","observation_id":"0334c2b0-ce0c-4df3-8685-b277757b0305","resolution":{"observed_at":"2026-08-06T21:11:18.384644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15512","snapshot_observed_at":"2026-08-06T05:48:31.618529Z","title":"T2vshield: Model-agnostic jailbreak defense for text- to-video models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01272","last_updated":"2025-08-14T03:08:33Z","snapshot_observed_at":"2026-08-18T00:09:47.197032Z","submitted_at":"2025-08-02T09:09:40Z","title":"PromptSafe: Gated Prompt Tuning for Safe Text-to-Image Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T05:48:31.618529Z"},"links":{"cited_paper":"/paper/2504.15512","citing_paper":"/paper/2508.01272"},"observation_digest":"sha256:98e337cfd8ac0bd27e018fd2f7d73cc709c1bcc33510458f057ce1079d0085f8","observation_id":"cb9f7893-f182-42ee-95f0-752afcaef785","resolution":{"observed_at":"2026-08-06T05:48:31.618529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15512","snapshot_observed_at":"2026-08-05T22:32:12.104256Z","title":"T2vshield: Model- agnostic jailbreak defense for text-to-video models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.06841","last_updated":"2025-08-09T05:48:30Z","snapshot_observed_at":"2026-08-16T03:27:28.000613Z","submitted_at":"2025-08-09T05:48:30Z","title":"Memory Enhanced Fractional-Order Dung Beetle Optimization for Photovoltaic Parameter Identification","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T22:32:12.104256Z"},"links":{"cited_paper":"/paper/2504.15512","citing_paper":"/paper/2508.06841"},"observation_digest":"sha256:98a7d148e8fabd3ce79de0772062989b4152b2ca5c404e6657a89292b76f77da","observation_id":"a18d13ab-2ae5-4b5c-8476-c2367d9da5aa","resolution":{"observed_at":"2026-08-05T22:32:12.104256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15512","snapshot_observed_at":"2026-08-04T14:58:39.157286Z","title":"T2vshield: Model-agnostic jailbreak defense for text-to-video models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.22415","last_updated":"2026-07-15T06:42:59Z","snapshot_observed_at":"2026-08-17T15:37:22.862610Z","submitted_at":"2025-09-26T14:39:13Z","title":"Evidence Recomposition and Predictive Context Residualization for Visual Attribution in Multimodal Large Language Models","version":4},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T14:58:39.157286Z"},"links":{"cited_paper":"/paper/2504.15512","citing_paper":"/paper/2509.22415"},"observation_digest":"sha256:cad083e9cecff3ad1687406f25f7008047dff88274c8abedcdf9d570a55ca3af","observation_id":"359f2b2a-fd58-49fc-bdf2-aa81da3cc33d","resolution":{"observed_at":"2026-08-04T14:58:39.157286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"cited_work":{"arxiv_id":"2504.15512","doi":"10.48550/arxiv.2504.15512","metadata_source":"pith","pith_arxiv_id":"2504.15512","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","venue":"cs.CR","work_id":"ecc5f713-3162-49d4-9ee3-0aa5c99fd963","year":2025},"citing_paper":{"arxiv_id":"2607.17279","last_updated":"2026-07-19T14:52:31Z","snapshot_observed_at":"2026-08-14T12:09:03.938096Z","submitted_at":"2026-07-19T14:52:31Z","title":"Between Safe Boundaries: Exploiting Temporal Consistency for Jailbreaking Text-To-Video Generation Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T18:33:04.359697Z"},"links":{"cited_paper":"/paper/2504.15512","citing_paper":"/paper/2607.17279"},"observation_digest":"sha256:ba463825b2573d91f912dffd0012bbddf088ee7456d29c00f45633a49fc298f8","observation_id":"0dc3c95a-3ec9-4bf0-84d0-6adc97ae0489","resolution":{"observed_at":"2026-08-01T18:33:18.799834Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15512","snapshot_observed_at":"2026-08-12T14:01:41.409683Z","title":"T2vshield: Model-agnostic jailbreak defense for text- to-video models.arXiv preprint arXiv:2504.15512, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10933","last_updated":"2026-08-11T14:01:24Z","snapshot_observed_at":"2026-08-14T23:12:19.845019Z","submitted_at":"2026-08-11T14:01:24Z","title":"SafeCA: Safe Cross-Attention Localization and Regulation for Text-to-Video Jailbreak Defense","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T14:01:41.409683Z"},"links":{"cited_paper":"/paper/2504.15512","citing_paper":"/paper/2608.10933"},"observation_digest":"sha256:14c318a04dedd2c0a11b155cd8ba34f5c9bd22febb80f9072c2de8c486b05b38","observation_id":"75b6184d-628f-4045-8014-aa06a4e4f31a","resolution":{"observed_at":"2026-08-12T14:01:41.409683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.15512/citation-record","integrity":"/paper/2504.15512/integrity","json":"/paper/2504.15512/citation-record.json","paper":"/paper/2504.15512"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-17T07:44:10.213698Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-16T11:31:10.986955Z","title":"Hunyuanvideo: A systematic framework for large video genera- tive models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:10.986955Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:0ca52bd2b1154f489fdd3c9b5fd73f78837fb6d51545506937b4b50479f7f1fc","observation_id":"7abbdc4e-dbba-43b0-b1e7-897a1af07bce","resolution":{"observed_at":"2026-08-16T11:31:10.986955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-17T12:45:30.627161Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-16T11:31:10.992254Z","title":"Stable video diffusion: Scaling latent video diffu- sion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:10.992254Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:63d5f6a64f146e0a5b2f7f5485f9655ab19e99831509af3c9c2cc008d491904b","observation_id":"c77403a9-4d4c-4222-bc7b-69e84c9a9549","resolution":{"observed_at":"2026-08-16T11:31:10.992254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14125","last_updated":"2024-06-04T17:25:20Z","snapshot_observed_at":"2026-08-14T12:12:01.418974Z","submitted_at":"2023-12-21T18:46:41Z","title":"VideoPoet: A Large Language Model for Zero-Shot Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14125","snapshot_observed_at":"2026-08-16T11:31:10.996669Z","title":"Videopoet: A large language model for zero-shot video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:10.996669Z"},"links":{"cited_paper":"/paper/2312.14125","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:199612eec4c16437d34411089e377c28832ffbb89d1348d0b397cca1e3d7fd35","observation_id":"064640d3-9348-4891-8f78-4b964b6d78ba","resolution":{"observed_at":"2026-08-16T11:31:10.996669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-16T11:31:11.002900Z","title":"Make-a-video: Text-to-video genera- tion without text-video data","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.002900Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:4f7c7e577c7860f1d9ac517e555e4255a68fc3fcd69a224629b6fb0b24a44a49","observation_id":"55ec58ad-d957-47d0-8f38-feb9127f14e1","resolution":{"observed_at":"2026-08-16T11:31:11.002900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.410927Z","title":"Tune-a-video: One-shot tuning of image diffusion models for text-to-video generation","venue":null,"work_id":"92007427-8469-4eb7-abaf-71b0d8ec4add","year":2023},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.008499Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:3063fa5535eb9be306fecdbe9bd01eb847d186bcb667d3098e6167810c2a8643","observation_id":"f76bfdbf-1373-42b3-b947-5d3c9d0ad152","resolution":{"observed_at":"2026-08-16T11:31:12.415582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.395283Z","title":"Show-1: Marrying pixel and latent diffusion models for text-to-video generation","venue":null,"work_id":"8bd455d3-4759-42a5-ab18-4583d8f398c9","year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.013544Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:eddb6ff8cc8f491fede407da52b88789d1b1d86da546c73784cf2f105f9dc1c2","observation_id":"f4614af4-3a9c-4db7-a4a3-d4aac736e134","resolution":{"observed_at":"2026-08-16T11:31:12.400795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.380151Z","title":"The cen- tral role of recognition in auditory perception: a neurobiological model","venue":null,"work_id":"67bbe44e-1426-47cf-b30a-6ec419941a57","year":2010},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.018688Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:546cb8058c41b2d5ab5ca51de22e9e631bae2403e95f2092ae3cd3823450cd9e","observation_id":"4565fc9a-96dd-4665-bc5b-b55fcd696a1a","resolution":{"observed_at":"2026-08-16T11:31:12.384730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18072","last_updated":"2024-10-23T17:56:11Z","snapshot_observed_at":"2026-08-16T13:06:31.854495Z","submitted_at":"2024-10-23T17:56:11Z","title":"WorldSimBench: Towards Video Generation Models as World Simulators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18072","snapshot_observed_at":"2026-08-16T11:31:11.023196Z","title":"Worldsimbench: Towards video generation models as world sim- ulators","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.023196Z"},"links":{"cited_paper":"/paper/2410.18072","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:8a42199886038b54a6107eff7b4a3c6efef1fa17be0c9d69bd53f71aab92858f","observation_id":"5611993c-b7a7-4b1f-8fff-e4ab42ac34b6","resolution":{"observed_at":"2026-08-16T11:31:11.023196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17177","last_updated":"2024-04-17T18:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T03:30:58Z","title":"Sora: A Review on Background, Technology, Limitations, and Opportunities of Large Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17177","snapshot_observed_at":"2026-08-16T11:31:11.028033Z","title":"Sora: A Springer Nature 2021 LATEX template 22 Article Title review on background, technology, limitations, and opportunities of large vision models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.028033Z"},"links":{"cited_paper":"/paper/2402.17177","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:c3ab76f8eee68275eea0d7707ce712262eead19e80147e932d4a94b8b2a00244","observation_id":"12b3f0fc-b13e-438c-bfbf-47f41a0050dc","resolution":{"observed_at":"2026-08-16T11:31:11.028033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-16T11:31:11.034339Z","title":"Open- sora: Democratizing efficient video production for all","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.034339Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:c615baf84f0b103f867c2900009fdf3c3c9063f44664a6aea14fd48cd42f2060","observation_id":"ef14bcb7-95ab-498c-8778-596ce938b5c2","resolution":{"observed_at":"2026-08-16T11:31:11.034339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-08-15T19:52:28.153954Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-16T11:31:11.039149Z","title":"Cogvideox: Text-to-video diffu- sion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.039149Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:1595c265753e17594bf14b707c6eed72e8ff1568c07566fab5d99a6ece33ca83","observation_id":"bdf051ba-644c-4469-ac06-2dcbbfd2a204","resolution":{"observed_at":"2026-08-16T11:31:11.039149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10674","last_updated":"2024-05-17T10:09:09Z","snapshot_observed_at":"2026-08-16T13:51:54.926973Z","submitted_at":"2024-05-17T10:09:09Z","title":"From Sora What We Can See: A Survey of Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10674","snapshot_observed_at":"2026-08-16T11:31:11.043802Z","title":"From sora what we can see: A survey of text-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.043802Z"},"links":{"cited_paper":"/paper/2405.10674","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:77a9091d924f7408fc2d7a1b5025745d3ecf5863ea8ff8d703848f218bc3b93d","observation_id":"e8ca93fb-f5b7-4897-8329-ec387d82d8d9","resolution":{"observed_at":"2026-08-16T11:31:11.043802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.364168Z","title":"T2v-ddpm: Thermal to visible face translation using denoising diffusion probabilistic models","venue":null,"work_id":"4330c7f3-d7e7-42a5-94d1-5b368c2b38fe","year":2023},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.048533Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:b2ff3a5131129d5f66b29809ddd81c1b3ed710576a401a3c016eda52fe2e4930","observation_id":"caae0f3c-094a-4830-a5f6-b213502a2710","resolution":{"observed_at":"2026-08-16T11:31:12.369415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:11.053321Z","title":"T2v-turbo-v2: Enhancing video generation model post-training through data, reward, and conditional guidance design","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.053321Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:810da01246835737b511c74001398310f98739bcd18c47ccbf4964920baed825","observation_id":"ad248d88-197b-4f1e-b4cf-97e2a3a94c23","resolution":{"observed_at":"2026-08-16T11:31:11.053321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.348511Z","title":"Videotetris: Towards compositional text-to-video generation","venue":null,"work_id":"68e6d59c-e131-4e0c-b7ae-0fcf90d0365d","year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.058136Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:ea3f60c4c0bf1ea634b2afab819f88248bab2ab3f3b08b8e650efbc61db9ed78","observation_id":"55a63db7-e49b-4fba-80b6-afca8be2cf00","resolution":{"observed_at":"2026-08-16T11:31:12.353777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.333416Z","title":"Evaluation of text-to-video generation models: A dynam- ics perspective","venue":null,"work_id":"bb5bf1dc-776e-491e-93fa-8db691c8758b","year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.062303Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:878ba0102aed29bab0c7710290c552d7bc03cef7e51c4b1ba6166bd564e3c40e","observation_id":"aaa0d8f9-72c1-44cf-af1b-109e1753dbb4","resolution":{"observed_at":"2026-08-16T11:31:12.338225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.318602Z","title":"T2vsafetybench: Evaluating the safety of text-to-video genera- tive models","venue":null,"work_id":"d7d98e4d-9750-4929-9972-53761045ad4a","year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.066444Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:b7dd9af1c8738941f031f62b7ed04dace22017fa604f1c874889718b59fbea75","observation_id":"e9d7a5e6-da37-4832-919a-cc1952e2f149","resolution":{"observed_at":"2026-08-16T11:31:12.323228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.305720Z","title":"Safree: Training- free and adaptive guard for safe text-to-image and video generation","venue":null,"work_id":"cbaf96fa-d7c9-47df-bc23-e80351cd7b3c","year":null},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.070839Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:c2c8881b8b58c3328ff5d778ab1e029b4e89559bedc4aeeb77a8bb8184aa8e62","observation_id":"a859e748-a452-46c0-9732-51400e3d0c0d","resolution":{"observed_at":"2026-08-16T11:31:12.309676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.291938Z","title":"Defending chatgpt against jail- break attack via self-reminders","venue":null,"work_id":"9fb134d2-e6c3-42a7-accc-cbc18c67be09","year":2023},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.074990Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:b65cb132130f02fad30df327cc56de065f893512e6a8656526bbb738d3fa4812","observation_id":"2c956151-d439-4720-89b2-b9bdbb44f7b2","resolution":{"observed_at":"2026-08-16T11:31:12.296005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14872","last_updated":"2024-02-27T13:49:22Z","snapshot_observed_at":"2026-08-18T14:36:23.102820Z","submitted_at":"2024-02-21T15:13:50Z","title":"Semantic Mirror Jailbreak: Genetic Algorithm Based Jailbreak Prompts Against Open-source LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14872","snapshot_observed_at":"2026-08-16T11:31:11.079327Z","title":"Semantic mirror jailbreak: Genetic algorithm based jail- break prompts against open-source llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.079327Z"},"links":{"cited_paper":"/paper/2402.14872","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:62b4dc9226054e250fb3dfbe848b4fdbdb752993ff20483de13dcf57e4906dba","observation_id":"ddd0d44f-7468-4469-bfae-cfc8a85ae9e3","resolution":{"observed_at":"2026-08-16T11:31:11.079327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.277718Z","title":"Don’t listen to me: understanding and explor- ing jailbreak prompts of large language models","venue":null,"work_id":"d34d7ccf-47d9-4802-b1a3-f4ed12463b47","year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.084788Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:4d2d56171580c61a9da7317eb9529a2ae9ed865f13c5e97972ca04372cf7b088","observation_id":"8321eda4-f5e4-47c9-8e55-ba5d0fe2517c","resolution":{"observed_at":"2026-08-16T11:31:12.282419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09002","last_updated":"2025-03-18T01:50:42Z","snapshot_observed_at":"2026-08-17T16:41:27.465444Z","submitted_at":"2024-01-17T06:42:44Z","title":"AttackEval: How to Evaluate the Effectiveness of Jailbreak Attacking on Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09002","snapshot_observed_at":"2026-08-16T11:31:11.088568Z","title":"Attackeval: How to evaluate the effectiveness of jailbreak attack- ing on large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.088568Z"},"links":{"cited_paper":"/paper/2401.09002","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:ae2a4eeb585ce4c0cb630521c0051ba11b4db0b28bf852478df2be990642c54d","observation_id":"7b5d5d68-8587-4fe9-947a-66daea9a34d8","resolution":{"observed_at":"2026-08-16T11:31:11.088568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-17T07:16:08.436720Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-16T11:31:11.092728Z","title":"Jailbreak vision language models via bi-modal adversarial prompt","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.092728Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:b4c626dfb8ae743ce8207500c21dd32d105c7f9d70fb0e5af0dae749f29de260","observation_id":"4ae8d774-f9cd-41b2-b352-61eb00eb7c9d","resolution":{"observed_at":"2026-08-16T11:31:11.092728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-08-18T10:26:02.157762Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-16T11:31:11.096723Z","title":"Comprehensive assessment of jailbreak attacks against llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.096723Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:8258394ef89d8983962deb92cb7054d4c96da61bac16514fe1993dbb62fec8ab","observation_id":"e9ac42be-9b76-4feb-8007-6352253bc8f0","resolution":{"observed_at":"2026-08-16T11:31:11.096723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.06083","last_updated":"2019-09-04T18:53:10Z","snapshot_observed_at":"2026-08-07T14:27:46.872660Z","submitted_at":"2017-06-19T17:53:11Z","title":"Towards Deep Learning Models Resistant to Adversarial Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.06083","snapshot_observed_at":"2026-08-16T11:31:11.100823Z","title":"Towards deep learning models resis- tant to adversarial attacks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.100823Z"},"links":{"cited_paper":"/paper/1706.06083","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:d9a780965b81b9c20807e1c10b838e4a6b41c0d9b14e9ef66a580c9048a0feb5","observation_id":"f93a3ed3-7f60-4e2d-9506-95d9514c548d","resolution":{"observed_at":"2026-08-16T11:31:11.100823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:11.105193Z","title":"Advances in adversarial attacks and defenses in computer vision: A survey.IEEE Access, 9:155161–155196, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.105193Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:7dce4a66ea37c07c1256b63456a27500bfa823f836d0fa6e318410dd8d08401e","observation_id":"d6cd2ac8-48fd-412e-bfd3-a792482559bf","resolution":{"observed_at":"2026-08-16T11:31:11.105193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:11.109484Z","title":"kling, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.109484Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:a79324b33effc5401af2de1bad12528b35c4547785bf4eb553eec9f6ac02aedc","observation_id":"d1cc6acc-86bf-47bc-8e68-c207d7329362","resolution":{"observed_at":"2026-08-16T11:31:11.109484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:11.114309Z","title":"URL https://pikartai.com","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.114309Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:cab10b42da8200346c8b8ce731d02c60a099c3be00a1cf79008a2ee64c492bf7","observation_id":"e8759e39-fab7-45b7-8302-252c536827fe","resolution":{"observed_at":"2026-08-16T11:31:11.114309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.235409Z","title":"Video diffusion models","venue":null,"work_id":"020017a5-3a55-4cf8-984a-e0f364b00f1a","year":2022},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.118705Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:f9c51e5033e7a1cb91f329a745b5e0eece9abf9f38c8a7cf58494e203df2f722","observation_id":"9c90469e-48b2-41c0-b227-58979e8e12a0","resolution":{"observed_at":"2026-08-16T11:31:12.240175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.221274Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":"18a0c596-6e73-4df2-a16c-df846327feff","year":2015},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.123160Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:1ccf79cb079c4482cb1143f82832c8f12d5e428a1a3abec2c8acc85ac27029f2","observation_id":"5763d097-510d-4c45-98e2-5480f4c2c24d","resolution":{"observed_at":"2026-08-16T11:31:12.225821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-08-13T01:39:12.659510Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-16T11:31:11.127847Z","title":"Videocrafter1: Open diffusion models for high-quality video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.127847Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:be3070519f0e09a6958fc2887f27a023b5f4b152a9f6e093b42fa1b4284721cc","observation_id":"5a06d73e-ed3e-4d7e-bfdd-7d7bc0dfc27f","resolution":{"observed_at":"2026-08-16T11:31:11.127847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:11.132611Z","title":"luma dream machine, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.132611Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:bb005bd0178d84ed28758e63c9ae7f2a7e7ef4b69336437c3e174d424bd1dcad","observation_id":"65637c00-3a15-4b87-8e59-43e464042159","resolution":{"observed_at":"2026-08-16T11:31:11.132611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:11.137060Z","title":"Perceptual-sensitive gan for generating adversarial patches","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.137060Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:d1fd5bc63f9386eb6c7b82afaa342a298a4a9965e72c3e64362e3d7f7ec7b27f","observation_id":"e2a0ad72-0529-446b-989a-40f8e94695a6","resolution":{"observed_at":"2026-08-16T11:31:11.137060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:11.141829Z","title":"Bias-based universal adversarial patch attack for automatic check-out","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.141829Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:4b2f0a9b47ec0c398c5b33048e8960f625789f193d81f7e397e788222bd53b71","observation_id":"59648b62-09d4-460f-9c3b-8a33cb47644b","resolution":{"observed_at":"2026-08-16T11:31:11.141829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.179002Z","title":"Spatiotemporal attacks for embodied agents","venue":null,"work_id":"bb028d6a-aa5d-49f3-8831-55546194e650","year":2020},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.146531Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:8bd8e2b332849ff46a2fcf9f419128119bd51483384bf986ac1550cc735adfd8","observation_id":"2ae3c1cd-054b-42c6-adb9-67ef4b4a23d0","resolution":{"observed_at":"2026-08-16T11:31:12.183828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.164411Z","title":"X-adv: Phys- ical adversarial object attacks against x-ray pro- hibited item detection","venue":null,"work_id":"2df5c649-ff0f-412b-bf3e-bc6ac7dd409f","year":2023},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.151502Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:e9f6ceefdc784014eb376caade7004a76bf4e218bdc90106b047945964db37cf","observation_id":"72fcdda6-3dbb-4a73-8e03-c34264547821","resolution":{"observed_at":"2026-08-16T11:31:12.169102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.149190Z","title":"Exploring the relationship between archi- tecture and adversarially robust generalization","venue":null,"work_id":"580fb28d-1b83-4999-80ad-3ffd7deb2624","year":2023},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.155868Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:83806ea803a37038eefed552fd86470e50c40031cb5905b32cc4aa9209167e47","observation_id":"516100f9-153a-4b74-a9f3-1f8bbf8e232d","resolution":{"observed_at":"2026-08-16T11:31:12.153876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:11.160286Z","title":"Training robust deep neural networks via adversarial noise propagation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.160286Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:823a7d3a3b8b5bade5bf2bbc1758f8ac145300493c6d923ee745d1d5da1b0cc0","observation_id":"3299e4d3-5587-41e1-9160-4a733f2122f5","resolution":{"observed_at":"2026-08-16T11:31:11.160286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.12641","last_updated":"2019-05-13T07:22:16Z","snapshot_observed_at":"2026-08-14T17:50:49.224322Z","submitted_at":"2018-11-30T06:55:22Z","title":"Transferable Adversarial Attacks for Image and Video Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.12641","snapshot_observed_at":"2026-08-16T11:31:11.164748Z","title":"Transferable adversarial attacks for image and video object detection","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.164748Z"},"links":{"cited_paper":"/paper/1811.12641","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:970bf4da230b2ccb0262a576c35a81e3b2fc7aade1e26f745724473aefd25b5c","observation_id":"f6ff017d-31d7-4f23-8f35-06c1b0448f11","resolution":{"observed_at":"2026-08-16T11:31:11.164748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.123529Z","title":"Compromis- ing embodied agents with contextual backdoor attacks, 2024","venue":null,"work_id":"f60d5a21-bea4-4b83-939a-a8c2106a330f","year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.169562Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:e2c14099467bb023ee6bed839484b3af8c0b01e80792d5bb2c3221d4b1abac70","observation_id":"dbb1a781-4d56-4006-9034-e50b4f4d8481","resolution":{"observed_at":"2026-08-16T11:31:12.128299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.108810Z","title":"Pre-trained trojan attacks for visual recognition","venue":null,"work_id":"2cb6fadd-2a42-4d38-84f0-b2161476a4e5","year":2025},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.174140Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:3a9c303472ddc25902cacce2670d4bc45e9460ac85224ecd4145f127d5879f96","observation_id":"0d8c78b6-11b4-46e1-b237-aead2b4a3295","resolution":{"observed_at":"2026-08-16T11:31:12.113498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.093033Z","title":"Bad- clip: Dual-embedding guided backdoor attack on multimodal contrastive learning","venue":null,"work_id":"43f1c308-80ab-43e8-9081-ddf1cb00ff79","year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.179181Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:d26f1165d886059b3fb33d108189ed4bb8e5152a2ba1bbb4586e352937fc0da6","observation_id":"b5ab356f-94e4-4436-b0f6-b1bc2336b7ac","resolution":{"observed_at":"2026-08-16T11:31:12.098483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11473","last_updated":"2024-02-18T06:31:05Z","snapshot_observed_at":"2026-08-16T22:50:36.518159Z","submitted_at":"2024-02-18T06:31:05Z","title":"Poisoned Forgery Face: Towards Backdoor Attacks on Face Forgery Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11473","snapshot_observed_at":"2026-08-16T11:31:11.183679Z","title":"Poi- soned forgery face: Towards backdoor attacks on face forgery detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.183679Z"},"links":{"cited_paper":"/paper/2402.11473","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:148d2019d7c124eaff1200d390e020e0652fcb14efd826ae0a400ca32629b435","observation_id":"244b01aa-a766-4518-b2ca-e5ffd7570413","resolution":{"observed_at":"2026-08-16T11:31:11.183679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13851","last_updated":"2024-02-21T14:54:30Z","snapshot_observed_at":"2026-08-16T14:16:34.445544Z","submitted_at":"2024-02-21T14:54:30Z","title":"VL-Trojan: Multimodal Instruction Backdoor Attacks against Autoregressive Visual Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13851","snapshot_observed_at":"2026-08-16T11:31:11.188335Z","title":"Vl-trojan: Multimodal instruction backdoor attacks against autoregres- sive visual language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.188335Z"},"links":{"cited_paper":"/paper/2402.13851","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:9de40cead4fec0b1dd1eb051e246aebc7f126d9815a44260855fddde131cc120","observation_id":"e865ff22-c32b-49e8-a4fe-b900a84afbc3","resolution":{"observed_at":"2026-08-16T11:31:11.188335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16134","last_updated":"2024-05-30T04:45:11Z","snapshot_observed_at":"2026-08-18T06:56:56.051501Z","submitted_at":"2024-05-25T08:57:30Z","title":"Breaking the False Sense of Security in Backdoor Defense through Re-Activation Attack","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16134","snapshot_observed_at":"2026-08-16T11:31:11.193068Z","title":"Breaking the false sense of security in back- door defense through re-activation attack","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.193068Z"},"links":{"cited_paper":"/paper/2405.16134","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:8c392119bbf2c1518c5a5fbf0104d0afe5653c675e13d40d9d14e664eadcf305","observation_id":"4b770b76-b2c2-4580-b96f-1db9659323e4","resolution":{"observed_at":"2026-08-16T11:31:11.193068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11071","last_updated":"2025-02-06T04:37:01Z","snapshot_observed_at":"2026-08-18T16:00:09.513146Z","submitted_at":"2024-08-18T03:16:59Z","title":"DiffZOO: A Purely Query-Based Black-Box Attack for Red-teaming Text-to-Image Generative Model via Zeroth Order Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11071","snapshot_observed_at":"2026-08-16T11:31:11.197817Z","title":"Diffzoo: A purely query-based black-box attack for red-teaming text-to-image generative model via zeroth order optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.197817Z"},"links":{"cited_paper":"/paper/2408.11071","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:403dbffe7bce4a9c5713d1e7f1cb200fade60737f9817a12728fd9066cf80c42","observation_id":"a98a0230-1383-471b-b7ba-cc24a66836fb","resolution":{"observed_at":"2026-08-16T11:31:11.197817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.076503Z","title":"Divide-and- conquer attack: Harnessing the power of llm to bypass the censorship of text-to-image genera- tion model","venue":null,"work_id":"de0ff0d8-b358-445f-9e15-532f3cb5d61a","year":2023},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.202466Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:9a00a9aaf4a2674729846380fd26adfe65c8483f9e1ad70b41e5c6a50ff88a19","observation_id":"f56f6589-35c9-459f-bdb1-0d916cc904df","resolution":{"observed_at":"2026-08-16T11:31:12.081914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00523","last_updated":"2025-06-24T18:55:29Z","snapshot_observed_at":"2026-08-19T03:06:35.226919Z","submitted_at":"2024-08-01T12:54:46Z","title":"Fuzz-Testing Meets LLM-Based Agents: An Automated and Efficient Framework for Jailbreaking Text-To-Image Generation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00523","snapshot_observed_at":"2026-08-16T11:31:11.206726Z","title":"Jailbreaking text-to- image models with llm-based agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.206726Z"},"links":{"cited_paper":"/paper/2408.00523","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:50d0327c0835d7efeb9429e8a26694577bd55205fc93d96b7d45a9dc4362cc26","observation_id":"d01c59cf-8cd7-409e-8333-67e76bb2f982","resolution":{"observed_at":"2026-08-16T11:31:11.206726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.061775Z","title":"Mma- diffusion: Multimodal attack on diffusion mod- els","venue":null,"work_id":"78e6db82-0bcd-4f7e-a7a8-3fe39ad9223e","year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.211304Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:b1abd9383923254275c81e73ce660e04235417f9d4ebbd20b6c9b13fa46ea9c1","observation_id":"2bf22588-ebf5-489a-a37f-44434894120f","resolution":{"observed_at":"2026-08-16T11:31:12.066373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.047378Z","title":"Sneakyprompt: Jailbreaking text-to-image generative models","venue":null,"work_id":"44962678-f99c-48c5-8613-3bf77b4e360e","year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.215672Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:ae21520d265c791e321eca474eb108b4c4bcb503373a38823f8bcba782b4c56a","observation_id":"3c3289cc-014d-4644-9e8e-b2a0bd3f8bef","resolution":{"observed_at":"2026-08-16T11:31:12.051636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.033484Z","title":"Safebench: A safety eval- uation framework for multimodal large language models, 2024","venue":null,"work_id":"28dfbd6f-5cb3-4389-a3a4-a20290bccf3f","year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.219978Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:4b9b02af83e941fe6090e791b74523669de03c41fde87c365f9bd5f667866b40","observation_id":"17dad243-fc06-4e8f-a4a0-126a78d50984","resolution":{"observed_at":"2026-08-16T11:31:12.038153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:12.019518Z","title":"Trojanrobot: Physical-world backdoor attacks against vlm- based robotic manipulation, 2025","venue":null,"work_id":"44d05e0e-a22c-4f43-ad15-9174857a5939","year":2025},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.223744Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:7a99188f383a6b082ea2f6993dd90b636e0fcd28e1b1b199f8828d08761371cf","observation_id":"da66dcb0-3fdb-4282-b1f3-8f0e59799ca0","resolution":{"observed_at":"2026-08-16T11:31:12.024268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06878","last_updated":"2024-12-09T18:59:04Z","snapshot_observed_at":"2026-08-17T19:33:37.938587Z","submitted_at":"2024-12-09T18:59:04Z","title":"SafeWatch: An Efficient Safety-Policy Following Video Guardrail Model with Transparent Explanations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06878","snapshot_observed_at":"2026-08-16T11:31:11.227222Z","title":"Safewatch: An efficient safety-policy following video guardrail model with transparent explanations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.227222Z"},"links":{"cited_paper":"/paper/2412.06878","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:984c0fa59a73480082e40e218e59c71544cd5f2c2634661a64b7eef81948bf11","observation_id":"8600c8a9-2573-4878-8f7b-74387e8aaa9a","resolution":{"observed_at":"2026-08-16T11:31:11.227222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-08-16T14:16:46.139055Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-08-16T11:31:11.230991Z","title":"A comprehensive study of jail- break attack versus defense for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.230991Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:127d9b77a282674f586fe2a33de48642dbb5be5d59e1030d62cb1d4eca2781e3","observation_id":"f5d471d0-c8a9-4c1b-87ac-7d6bc8e92398","resolution":{"observed_at":"2026-08-16T11:31:11.230991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04295","last_updated":"2024-08-30T11:57:47Z","snapshot_observed_at":"2026-08-12T17:45:10.384900Z","submitted_at":"2024-07-05T06:57:30Z","title":"Jailbreak Attacks and Defenses Against Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04295","snapshot_observed_at":"2026-08-16T11:31:11.234834Z","title":"Jailbreak attacks and defenses against large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.234834Z"},"links":{"cited_paper":"/paper/2407.04295","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:fe440d87e8041316bd0e3feb24ed70b8e6edc4616bf41b693ba788ae62fbee55","observation_id":"497faa89-52ac-4cab-a291-fd86c6b776e7","resolution":{"observed_at":"2026-08-16T11:31:11.234834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04783","last_updated":"2024-11-14T18:14:00Z","snapshot_observed_at":"2026-08-18T06:55:39.053097Z","submitted_at":"2024-03-02T16:52:22Z","title":"AutoDefense: Multi-Agent LLM Defense against Jailbreak Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04783","snapshot_observed_at":"2026-08-16T11:31:11.238811Z","title":"Autodefense: Multi- agent llm defense against jailbreak attacks.arXiv preprint arXiv:2403.04783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.238811Z"},"links":{"cited_paper":"/paper/2403.04783","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:6c7ec1b566d27ea439b09242f374a16b0946d9623342cb26b0f3271acdd7044b","observation_id":"c9f61786-26dd-48ea-83e1-d3002b0515cc","resolution":{"observed_at":"2026-08-16T11:31:11.238811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20099","last_updated":"2025-06-04T02:59:37Z","snapshot_observed_at":"2026-08-18T08:30:14.361603Z","submitted_at":"2024-05-30T14:40:35Z","title":"Defensive Prompt Patch: A Robust and Interpretable Defense of LLMs against Jailbreak Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20099","snapshot_observed_at":"2026-08-16T11:31:11.243411Z","title":"Defensive prompt patch: A robust and interpretable defense of llms against jail- break attacks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.243411Z"},"links":{"cited_paper":"/paper/2405.20099","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:c0209cef8f0324a0033954a99190721d1e975bbce2bd498268627b6236213279","observation_id":"2a25d2b8-95b7-4f19-97cd-5e1567a4a9c4","resolution":{"observed_at":"2026-08-16T11:31:11.243411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12761","last_updated":"2025-03-14T04:47:39Z","snapshot_observed_at":"2026-08-19T10:12:48.955804Z","submitted_at":"2024-10-16T17:32:23Z","title":"SAFREE: Training-Free and Adaptive Guard for Safe Text-to-Image And Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12761","snapshot_observed_at":"2026-08-16T11:31:11.248279Z","title":"Safree: Training-free and adaptive guard for safe text- to-image and video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.248279Z"},"links":{"cited_paper":"/paper/2410.12761","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:1169f649b465b910d69df376846d7d7b9d4c659a0fd3f431207b52a75d69d2fb","observation_id":"6e8a44fd-9b4c-448b-ae6b-ffff0f3ff5ed","resolution":{"observed_at":"2026-08-16T11:31:11.248279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:11.253198Z","title":"Detoxify","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.253198Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:8bed65fe539d608eac87971effee0ed4cd71cbe8622bcca7378ba2cf2b86ee38","observation_id":"ee4e7ed2-df7e-4956-9635-28c414a145be","resolution":{"observed_at":"2026-08-16T11:31:11.253198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:11.993560Z","title":"Deep nn for nsfw detection","venue":null,"work_id":"8f65b53c-ac69-4da7-8b8d-49d2c301551d","year":null},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.257503Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:24895f7141c1f929a3de09de69c82ad578fe252a9d008e3cbf4b17322599756d","observation_id":"d52cd9e3-1495-47f8-941c-d2ded67d4c91","resolution":{"observed_at":"2026-08-16T11:31:11.998426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:11.978205Z","title":"Blip-2: Bootstrapping language- image pre-training with frozen image encoders and large language models","venue":null,"work_id":"c5fb3ef6-1b3d-41b2-a165-d25f7aeeb01d","year":2023},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.262073Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:32b6557a64c51146f36e869fce1c74674fc988ff1054942810d38aceb52da37a","observation_id":"7906fb46-e9e8-4e87-985e-367b5f129a6e","resolution":{"observed_at":"2026-08-16T11:31:11.982904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:11.963157Z","title":"Ma-lmm: Memory- augmented large multimodal model for long- term video understanding","venue":null,"work_id":"d4d59446-2ed1-41b7-b8ee-7cb30401104c","year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.266567Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:d40d5aa41d51d71e5e476baef284a23acb7876afe49b3bec7e54bfcb1c7a8dd2","observation_id":"52d9e175-681c-4dbe-92d2-2547b2026d9f","resolution":{"observed_at":"2026-08-16T11:31:11.968147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.13461","last_updated":"2019-10-29T18:01:00Z","snapshot_observed_at":"2026-07-06T08:33:12.534026Z","submitted_at":"2019-10-29T18:01:00Z","title":"BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.13461","snapshot_observed_at":"2026-08-16T11:31:11.271124Z","title":"Bart: Denoising sequence-to-sequence pre-training for natural language generation, translation, and comprehension","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.271124Z"},"links":{"cited_paper":"/paper/1910.13461","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:96c2d88494133287548c4d19f8fa106354f25efe69f4170aae455f799c4d04f3","observation_id":"64ff2306-f851-4245-98db-9e0491ee9786","resolution":{"observed_at":"2026-08-16T11:31:11.271124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:11.276142Z","title":"Collecting highly parallel data for paraphrase evaluation","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.276142Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:3f3cf63562779091626ef58d6f20c92fc350a426cbf8b9fc9ce362643a63b3b7","observation_id":"477e757a-88c6-4ac6-9845-d7c6870af859","resolution":{"observed_at":"2026-08-16T11:31:11.276142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07895","last_updated":"2024-07-28T19:58:08Z","snapshot_observed_at":"2026-08-13T00:09:23.835117Z","submitted_at":"2024-07-10T17:59:43Z","title":"LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07895","snapshot_observed_at":"2026-08-16T11:31:11.280543Z","title":"Llava-next-interleave: Tackling multi-image, video, and 3d in large multimodal models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.280543Z"},"links":{"cited_paper":"/paper/2407.07895","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:4e757fa3c3957e3e99eb2e1cf8d000516852dd700266303f91623d1597059a28","observation_id":"3106cdac-8109-47ec-982b-77931f7dea43","resolution":{"observed_at":"2026-08-16T11:31:11.280543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-16T11:31:11.285737Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.285737Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:54d02bbddfc37f2242ba075115680529394f3478dfdb4ea669733ec0c0d18597","observation_id":"a661bae4-a924-410b-9fde-527070d215b3","resolution":{"observed_at":"2026-08-16T11:31:11.285737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-18T18:18:37.449517Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-16T11:31:11.290330Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.290330Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:5c8eaafd3a214778eb9ab3a5263e6ed8dd361dc6bb91f80dd0b4d24bec85716c","observation_id":"1a2969a7-4227-4149-a84c-09d55374d404","resolution":{"observed_at":"2026-08-16T11:31:11.290330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:11.294963Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.294963Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:a24bbb57e5de8da72832624c852c6563f44c39e6c17e29ed5c385377f0b2d728","observation_id":"4eb13313-cdb8-45bb-93f6-1d439ab96595","resolution":{"observed_at":"2026-08-16T11:31:11.294963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-18T07:20:18.686556Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-16T11:31:11.299949Z","title":"Jailbreaking attack against multimodal large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.299949Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:1da5b76326774efd50f89f9b9bfd126b408244fa4fa55d35c2ce095e6802dcbb","observation_id":"743677ba-3a19-4eb8-a161-aeb08b1ddc50","resolution":{"observed_at":"2026-08-16T11:31:11.299949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:11.928441Z","title":"Unsu- pervised temporal consistency metric for video segmentation in highly-automated driving","venue":null,"work_id":"55e74aa5-6751-44a0-8aad-01641bba9d28","year":2020},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.304459Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:747e75808adddd6846fd3d44574c57934f5e5f4a866e750186783d1347021cf1","observation_id":"4c2b2328-485c-4433-94c9-f8d019f0ac06","resolution":{"observed_at":"2026-08-16T11:31:11.933947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:11.912881Z","title":"Fvd: A new metric for video generation","venue":null,"work_id":"36f290a1-0641-41d4-8c30-369580ed5b4e","year":2019},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.309660Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:947fd606a643781e4bb69ae461525317312135d620bad350198fefb44acd8852","observation_id":"89561bf7-1093-4b58-a5e9-56289b062872","resolution":{"observed_at":"2026-08-16T11:31:11.918302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:11.896684Z","title":"This is an unsafe video","venue":null,"work_id":"cefa5682-7e5a-44a9-92ae-43fbd83ed814","year":2024},"citing_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:11.314401Z"},"links":{"citing_paper":"/paper/2504.15512"},"observation_digest":"sha256:774c30d4d5bd9c24c3b2c6db729bedb51bf693c1db100bb84e6e86b2f534bd46","observation_id":"80314db6-9ae9-4ec6-965c-a8a068f99fb7","resolution":{"observed_at":"2026-08-16T11:31:11.902354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","latest_version":2,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-18T00:47:28.167584Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":0,"verified_fuzzy":29},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 8 inbound Pith citation observations for arXiv:2504.15512."}