{"as_of":"2026-08-07T22:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:19a24aea31c66f851f44136a633c4acd1127966ad4be35c05ebeb5f5ef01f57d","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:44:17.234857Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.01591/citation-record","integrity":"/paper/2506.01591/integrity","json":"/paper/2506.01591/citation-record.json","paper":"/paper/2506.01591"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.04226","last_updated":"2023-03-07T20:36:13Z","snapshot_observed_at":"2026-07-06T14:59:53.901528Z","submitted_at":"2023-03-07T20:36:13Z","title":"A Comprehensive Survey of AI-Generated Content (AIGC): A History of Generative AI from GAN to ChatGPT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04226","snapshot_observed_at":"2026-08-07T11:44:14.885064Z","title":"A comprehensive survey of ai-generated content (aigc): A history of generative ai from gan to chatgpt.arXiv preprint arXiv:2303.04226, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:14.885064Z"},"links":{"cited_paper":"/paper/2303.04226","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:a5135befdfadd335537197dfaccf60fcabb9032497bbc4d8caaa08a71585083c","observation_id":"c1b45a53-fa21-447c-b667-d26fa4649800","resolution":{"observed_at":"2026-08-07T11:44:14.885064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.079707Z","title":"Diffusion models for impercepti- ble and transferable adversarial attack.IEEE Transactions on Pattern Analysis and Machine Intelligence, pages 1–17,","venue":null,"work_id":"87e789c9-5b69-41fe-a5cf-62eab2c6a521","year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:14.897655Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:f37dba51b86a33bb5233e3dd805103857f283b643a8654a76221f4beed2105d5","observation_id":"e702784d-0ad2-4bcf-83aa-190fea22e5c8","resolution":{"observed_at":"2026-08-07T11:44:18.084741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.067795Z","title":"Hierarchical cross-modal talking face generation with dynamic pixel-wise loss","venue":null,"work_id":"9705e926-6741-4996-954b-ab6ee74fd59a","year":2019},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:14.911408Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:e47e1ccacc88ee25de5d0bf90c6d86fdcd2dc3b3ba52e5650b8c3e300ed49bf7","observation_id":"58cb324e-b326-4a98-b274-dd3e82ed5835","resolution":{"observed_at":"2026-08-07T11:44:18.072039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.056984Z","title":"Content-based unrestricted ad- versarial attack","venue":null,"work_id":"0e504e41-2f97-4d44-a843-01892d9d0eae","year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:14.931922Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:b9522f8e461ec872c3c6b5769ad0c1eba188fdb6b78e8a20539b82d1cfabadc4","observation_id":"fe6d5802-3643-45a2-ac95-b382abaf40a3","resolution":{"observed_at":"2026-08-07T11:44:18.060946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.045489Z","title":"Echomimic: Lifelike audio-driven portrait animations through editable landmark conditioning, 2024","venue":null,"work_id":"65c48093-39a3-454a-8e58-e835d8c2b814","year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:14.956565Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:33fd540b1fe597edf9ff5e7e733e5a1f20eba1b27ada958c3d4fbac01a22bbfc","observation_id":"5e9ffa5b-09e5-45b2-88d2-e5e621813af1","resolution":{"observed_at":"2026-08-07T11:44:18.049109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.033771Z","title":"Out of time: auto- mated lip sync in the wild","venue":null,"work_id":"a0e3bd28-22fe-4dc9-a744-cdb2dea7f235","year":2016},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:14.969349Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:556045366437c56849e827d1ff79f4478a89614323132a41e4a813cd662f4b77","observation_id":"2b9d9e62-d1f7-4fe6-b3f2-a55a6cdfb269","resolution":{"observed_at":"2026-08-07T11:44:18.038372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.021981Z","title":"You said that?BMVC, 2017","venue":null,"work_id":"713607a0-5d8b-4dca-89a8-c77fa34288a2","year":2017},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:14.980534Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:6b9ed832f9ccc1f61be7452ac231431668c0ecf115fb820b1925f177c884209e","observation_id":"de99b4cf-0b7b-44e2-93a9-18cf9cd36070","resolution":{"observed_at":"2026-08-07T11:44:18.026304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-08-07T11:44:14.997364Z","title":"Hallo2: Long-duration and high-resolution audio-driven portrait im- age animation.arXiv preprint arXiv:2410.07718, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:14.997364Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:ed54b2d254020568eba4233da0bcc171072a6d4db1e486c8554833234b16ef21","observation_id":"a20423a8-e28c-4b29-acda-c0bfd3d5fe90","resolution":{"observed_at":"2026-08-07T11:44:14.997364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.010468Z","title":"On the detection of digital face manipulation","venue":null,"work_id":"a1c94254-ed1f-4d29-9ea4-8c774d74221a","year":2020},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:15.024369Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:42babdbe6cddfbceca63cf483c579bada0b1230bbdedeb4dc59d3509b7ec474b","observation_id":"7c74ef6c-c149-4968-b413-f023b69e6100","resolution":{"observed_at":"2026-08-07T11:44:18.014458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.998791Z","title":"Boosting adversarial at- tacks with momentum","venue":null,"work_id":"a84546bb-6d29-490b-8749-e247aceeb260","year":2018},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:15.040204Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:a15ea6037e9e60e5d796074ddc42aed35511f4c30dc746425d181115308439f9","observation_id":"d6850a48-7562-401b-bb00-e0e76a5e4166","resolution":{"observed_at":"2026-08-07T11:44:18.002904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.986795Z","title":"Evading defenses to transferable adversarial examples by translation-invariant attacks","venue":null,"work_id":"dcf34e4c-9922-428c-8588-5888b0f14f89","year":2019},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:15.054661Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:bb2764c178faa33c2ee0161448f2a4fa518c5df34d1d3d6bc195ee1212fd7808","observation_id":"7c5cfd35-6ef9-4092-81d4-9db3d4f54e2c","resolution":{"observed_at":"2026-08-07T11:44:17.991101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.974738Z","title":"Implicit generation and model- ing with energy based models","venue":null,"work_id":"ae52e302-f83a-4239-a2db-40b3fec770fb","year":2019},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:15.064228Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:99a71b6210b937a54ab13438c437bdeb66e782b7e440266801a2d1ac2f5ccafe","observation_id":"705943f7-22f2-4dd7-917d-75b64a38de26","resolution":{"observed_at":"2026-08-07T11:44:17.978715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:15.076857Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:15.076857Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:d5de45300f95efdbf0bd22d9032c831a9eb846ef73e9d44e6b449d3b7bad1980","observation_id":"fa0de445-97b3-402c-8c9a-faa2b47082e1","resolution":{"observed_at":"2026-08-07T11:44:15.076857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.956442Z","title":"Navi- gation instruction generation with bev perception and large language models","venue":null,"work_id":"7cc13a32-03fc-482d-a811-14fe6c21f15c","year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:15.089874Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:98ded7bd5f660db7686a8013461d979c18755ffe8d771f9e90fade4d810bc077","observation_id":"a5040ee2-50b6-4109-a6f5-9401e8858401","resolution":{"observed_at":"2026-08-07T11:44:17.960425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.945159Z","title":"Efficient emotional adaptation for audio-driven talking-head generation","venue":null,"work_id":"f4d58cc2-6a57-4aed-a549-ab18f6996698","year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:15.106415Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:ab02e8165c4fa043fa7ae9fe3866efa66395cd4dd25530a8d8b7b48f1459c6fd","observation_id":"0b3ff085-ed5d-42b6-a9fe-ff2fb151370d","resolution":{"observed_at":"2026-08-07T11:44:17.949474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.933453Z","title":"Patch-wise attack for fooling deep neu- ral network","venue":null,"work_id":"52261a50-5862-4e46-9ce7-74fe335d228f","year":2020},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:15.124626Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:024c0b50c83a9eeb7515faf28d2589fd8f0541ca627f963d82a93f6dfea55cd3","observation_id":"f251cb74-3b20-41b5-95b1-4deaec9cc695","resolution":{"observed_at":"2026-08-07T11:44:17.937543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:16.316039Z","title":"Generative adversarial nets.Advances in neural information processing systems, 27, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.316039Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:21cf384a3d69d8b06fd251330918f2594e26f4566f5cc1b7dffc4e8b18223fe1","observation_id":"ad1420cd-54d3-48de-8129-6e634c1f234b","resolution":{"observed_at":"2026-08-07T11:44:16.316039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6572","last_updated":"2015-03-20T20:19:16Z","snapshot_observed_at":"2026-07-06T04:04:16.777653Z","submitted_at":"2014-12-20T01:17:12Z","title":"Explaining and Harnessing Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6572","snapshot_observed_at":"2026-08-07T11:44:16.400248Z","title":"Explaining and harnessing adversarial examples.arXiv preprint arXiv:1412.6572, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.400248Z"},"links":{"cited_paper":"/paper/1412.6572","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:3599f11647d07a5edf1b1e074303d9ad0dbe20a93f2b2cf9bfd846fc0aef9cbd","observation_id":"9aa372c2-0652-4607-b677-36221f391387","resolution":{"observed_at":"2026-08-07T11:44:16.400248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.03263","last_updated":"2020-09-15T15:40:19Z","snapshot_observed_at":"2026-07-06T08:42:41.724791Z","submitted_at":"2019-12-06T18:00:36Z","title":"Your Classifier is Secretly an Energy Based Model and You Should Treat it Like One","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.03263","snapshot_observed_at":"2026-08-07T11:44:16.414421Z","title":"Your classifier is secretly an energy based model and you should treat it like one.arXiv preprint arXiv:1912.03263,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.414421Z"},"links":{"cited_paper":"/paper/1912.03263","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:652f49e2dd008ddcbb7606d4ebf884fe668122e6b3fdf8280eb438cf806cab34","observation_id":"30f1cf2b-3a8c-4cc9-8e8b-daee93b1f760","resolution":{"observed_at":"2026-08-07T11:44:16.414421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.914584Z","title":"Ad-nerf: Audio driven neural ra- diance fields for talking head synthesis","venue":null,"work_id":"6acd7a41-8cff-4cc2-a172-c324a54ee126","year":2021},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.432244Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:37bcb80558d83a5ea9f4cf13be523e79c050a2720369ea917cd5a69416aabeae","observation_id":"0d9594ef-201b-4a25-9c22-633340ea6eb0","resolution":{"observed_at":"2026-08-07T11:44:17.919481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:16.447667Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.447667Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:1dac41700ee5b157483170845c990772510e3782daba9ce72f5295605f21add0","observation_id":"616d6604-bd6a-4ab7-a647-dc97af630f7a","resolution":{"observed_at":"2026-08-07T11:44:16.447667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.13525","last_updated":"2021-03-18T19:39:26Z","snapshot_observed_at":"2026-07-06T09:23:52.102423Z","submitted_at":"2020-05-27T17:53:36Z","title":"Stochastic Security: Adversarial Defense Using Long-Run Dynamics of Energy-Based Models","version":2},"cited_work":{"arxiv_id":"2005.13525","doi":null,"metadata_source":"pith","pith_arxiv_id":"2005.13525","snapshot_observed_at":"2026-08-07T11:44:17.425925Z","title":"Stochastic Security: Adversarial Defense Using Long-Run Dynamics of Energy-Based Models","venue":"stat.ML","work_id":"91e4ce03-84f2-44ea-a748-2b142c3c1464","year":2020},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.461422Z"},"links":{"cited_paper":"/paper/2005.13525","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:f1e8436e704c464383458a4ea61d45d256cc041f165dc135efa30eb72af5618b","observation_id":"5cc057fb-6d7b-4afc-a7ed-f8df2a774af4","resolution":{"observed_at":"2026-08-07T11:44:17.432135Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:16.473690Z","title":"Denoising dif- fusion probabilistic models.Advances in neural information processing systems, 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.473690Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:a42af5d1181f42991c490e3bd3223ffd5ed0c89db9b73986a8166f44bfe920ed","observation_id":"d1e1e6d5-0b09-4ce2-bd5b-9701124bd491","resolution":{"observed_at":"2026-08-07T11:44:16.473690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.889624Z","title":"Animate anyone: Consistent and controllable image- to-video synthesis for character animation","venue":null,"work_id":"501af076-54eb-44bb-b245-c03f5e620d37","year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.490105Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:3fcf97fb71301de679927c73c3d993c92c0a6b87b5408156e30b809f1380b9f0","observation_id":"f33b1acb-5b43-43d9-a82e-25d885ac8541","resolution":{"observed_at":"2026-08-07T11:44:17.894187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.876781Z","title":"Progressive growing of gans for improved quality, stability, and variation","venue":null,"work_id":"4b9e6c9c-37e5-4181-a8e3-04f1cd03bec4","year":2018},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.503410Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:d4ae05242cd803e5dd349f7fca57b496d7369163d0e097d1014b6e73822c49ac","observation_id":"46f8a38a-b9a1-4204-b38d-f575191986a0","resolution":{"observed_at":"2026-08-07T11:44:17.881132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.865879Z","title":"Kingma and Max Welling","venue":null,"work_id":"7e8b2a86-30c9-4aa2-9bfb-352338f58c04","year":2014},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.517080Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:50d5771fd2ea3effb8b894b3c101d61e4d6f122c9bc31f1cd3dbb4cac094830c","observation_id":"a2906d9e-ccd9-4a6f-a8bb-962405e8903d","resolution":{"observed_at":"2026-08-07T11:44:17.869666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.853537Z","title":"Ad- versarial examples in the physical world","venue":null,"work_id":"926d5321-e739-4659-9c19-1769dd783d79","year":2018},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.529727Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:87902b3880a4d48e49551c7500ced4585716c0fc9b6c0cf5e6ea3e465fe0ff85","observation_id":"faaf48a8-80e8-4edf-ba97-55fafbf0f5d5","resolution":{"observed_at":"2026-08-07T11:44:17.858079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.842496Z","title":"Unganable: Defending against gan- based face manipulation","venue":null,"work_id":"6ba5dec5-9d4c-4add-8c92-5acbba8a84de","year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.548010Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:d4c7b60809ae5cf69e6d34bcf9e926c634afa00cd2cbda2c4c67153799c51ec6","observation_id":"0a8140fc-b773-4fd1-8ce6-a02184747951","resolution":{"observed_at":"2026-08-07T11:44:17.846501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12683","last_updated":"2023-05-22T03:43:34Z","snapshot_observed_at":"2026-07-06T15:30:26.626858Z","submitted_at":"2023-05-22T03:43:34Z","title":"Mist: Towards Improved Adversarial Examples for Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12683","snapshot_observed_at":"2026-08-07T11:44:16.566278Z","title":"Mist: Towards improved adversarial examples for diffusion models.arXiv preprint arXiv:2305.12683, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.566278Z"},"links":{"cited_paper":"/paper/2305.12683","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:3157c2727a830f019fc84a31f2f260205f7b8b304308f2f5a638b3a1d7eeeb9d","observation_id":"c7689ee1-7283-4e48-95e8-940de6ddeb66","resolution":{"observed_at":"2026-08-07T11:44:16.566278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.830127Z","title":"Adversarial example does good: Preventing paint- ing imitation from diffusion models via adversarial exam- ples","venue":null,"work_id":"21d9775f-1c11-44ab-87c0-d18a0d4fb3b8","year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.582514Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:cf5bb976da7732ab40c4c54ef650d6d78fbd1b239bb69cd9547954758b076d7f","observation_id":"93455dc4-a2f7-43d2-b84e-4bfb3e3d36d2","resolution":{"observed_at":"2026-08-07T11:44:17.835003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-07T11:44:16.598413Z","title":"Flow matching for generative mod- eling.arXiv preprint arXiv:2210.02747, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.598413Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:ee44a9fcbca847c211de4282d4c68d9932cf42493678ddd713201c7f346a4a89","observation_id":"9777f747-7081-407c-9230-aa018439d71a","resolution":{"observed_at":"2026-08-07T11:44:16.598413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:16.614034Z","title":"Fre- quency domain model augmentation for adversarial attack","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.614034Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:6ea7ec9e8c2abd9d4982d91b94fdd9a7c58ddca3524b3d18b16857dccbb941f4","observation_id":"0233fc10-0b14-4dee-b0b9-6492fa28b5fa","resolution":{"observed_at":"2026-08-07T11:44:16.614034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T11:44:16.630330Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.630330Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:f3a6c5db0bda242fcd25c5081c4c2e567936119f4f8f94864c90635310faa934","observation_id":"0da7ab64-71a7-4354-9365-14800cd2eadf","resolution":{"observed_at":"2026-08-07T11:44:16.630330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.06083","last_updated":"2019-09-04T18:53:10Z","snapshot_observed_at":"2026-08-07T14:27:46.872660Z","submitted_at":"2017-06-19T17:53:11Z","title":"Towards Deep Learning Models Resistant to Adversarial Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.06083","snapshot_observed_at":"2026-08-07T11:44:16.651294Z","title":"Towards deep learning models resis- tant to adversarial attacks.arXiv preprint arXiv:1706.06083,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.651294Z"},"links":{"cited_paper":"/paper/1706.06083","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:40bdb3e4c60b61549582e6d770766b672c348c4871585263aa4d5a2186199b7e","observation_id":"0bf4b434-c216-4995-9729-7298c24e5377","resolution":{"observed_at":"2026-08-07T11:44:16.651294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.07460","last_updated":"2022-05-16T06:03:00Z","snapshot_observed_at":"2026-08-04T18:06:26.992880Z","submitted_at":"2022-05-16T06:03:00Z","title":"Diffusion Models for Adversarial Purification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.07460","snapshot_observed_at":"2026-08-07T11:44:16.664363Z","title":"Diffusion models for adversarial purification.arXiv preprint arXiv:2205.07460,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.664363Z"},"links":{"cited_paper":"/paper/2205.07460","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:1ca0492d7c04170108741c6c26331cba25ad61ed1f3b96057e100aaaed727bb6","observation_id":"9ee559b8-3d80-4510-b798-bb89eb1da984","resolution":{"observed_at":"2026-08-07T11:44:16.664363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.811076Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"64af8713-5097-4594-b957-6c4d16871dcb","year":2022},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.679533Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:ab754f46fd35a1284260986cf872dcd873bbf2faea59ba631e49948ee8dfc1d5","observation_id":"51bff52c-8466-452f-8488-0c631aa95457","resolution":{"observed_at":"2026-08-07T11:44:17.815511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.797847Z","title":"Faceforen- sics++: Learning to detect manipulated facial images","venue":null,"work_id":"67bbd23b-282c-44b6-92b7-578c066bda33","year":2019},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.691621Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:693e0cc374ae02e68410d53da494c51788569da9295af9f280de19dc037ec363","observation_id":"420e11d0-9ab4-4e77-aa73-d057f1161c4b","resolution":{"observed_at":"2026-08-07T11:44:17.802803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.784946Z","title":"Dis- rupting deepfakes: Adversarial attacks against conditional image translation networks and facial manipulation systems","venue":null,"work_id":"4df24d35-6112-4a13-847d-ebf4dfdef7f1","year":2020},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.708468Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:3b3b93f8e7a046dc545ec3aa5add300fd55cec132dccb9190bb8a37950644a5c","observation_id":"3e80ee74-f2fd-4975-bd6e-9c906504bded","resolution":{"observed_at":"2026-08-07T11:44:17.789480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:16.721635Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.721635Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:a475d4d4e522b61d4c8a3a3c6ea0a1b9071472f5b0a020da41cdeec42923d3d4","observation_id":"e9f26956-c31d-413a-92ad-bc1295eac3d6","resolution":{"observed_at":"2026-08-07T11:44:16.721635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06588","last_updated":"2023-02-13T18:38:42Z","snapshot_observed_at":"2026-07-06T14:51:22.788392Z","submitted_at":"2023-02-13T18:38:42Z","title":"Raising the Cost of Malicious AI-Powered Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.06588","snapshot_observed_at":"2026-08-07T11:44:16.734736Z","title":"Raising the cost of malicious ai-powered image editing.arXiv preprint arXiv:2302.06588,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.734736Z"},"links":{"cited_paper":"/paper/2302.06588","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:a20802d19e7a5d5afd186eb3bf742f1800a617ff15546748c6bdd159c7090ec7","observation_id":"4545330a-ac10-4d15-b431-7702734848ab","resolution":{"observed_at":"2026-08-07T11:44:16.734736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.06605","last_updated":"2018-05-18T00:20:52Z","snapshot_observed_at":"2026-08-02T06:44:56.184651Z","submitted_at":"2018-05-17T05:38:55Z","title":"Defense-GAN: Protecting Classifiers Against Adversarial Attacks Using Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.06605","snapshot_observed_at":"2026-08-07T11:44:16.745038Z","title":"Defense-gan: protecting classifiers against adversarial attacks using generative models.arXiv preprint arXiv:1805.06605, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.745038Z"},"links":{"cited_paper":"/paper/1805.06605","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:09e98504579bad49ef3fc3c7fe79f92a959c73ae72f552f79660a695a2956a97","observation_id":"71baf364-b631-4cdd-80a9-a6bf1307bfd2","resolution":{"observed_at":"2026-08-07T11:44:16.745038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02234","last_updated":"2023-04-07T20:33:57Z","snapshot_observed_at":"2026-07-06T15:12:22.395669Z","submitted_at":"2023-04-05T05:30:09Z","title":"JPEG Compressed Images Can Bypass Protections Against AI Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02234","snapshot_observed_at":"2026-08-07T11:44:16.763658Z","title":"Jpeg compressed images can bypass protections against ai editing.arXiv preprint arXiv:2304.02234, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.763658Z"},"links":{"cited_paper":"/paper/2304.02234","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:21c68edcf98ffea4ab8035a0f4e4123dd26f2ca680bf5dcaeab457d478c44b85","observation_id":"a631c3f4-ed7e-4f69-99d1-516b6f00849c","resolution":{"observed_at":"2026-08-07T11:44:16.763658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.767678Z","title":"Difftalk: Crafting diffusion models for generalized audio-driven portraits animation","venue":null,"work_id":"1ec5b3c8-58a5-4e69-89dc-34aba4a219bf","year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.775066Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:cb9d044dd4dd74848681e880e03997bdb47067ef92813f0d8a25be7b63e97483","observation_id":"d1e1f296-d277-4679-8dcb-8c14109e2e87","resolution":{"observed_at":"2026-08-07T11:44:17.771977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.755130Z","title":"Detecting deep- fakes with self-blended images","venue":null,"work_id":"3c8b4309-32e7-43d5-a0ea-e359bdf63514","year":2022},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.790048Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:c2ba83b95de13ee8d948dda2e4896de686194699fd19567276f2d870e36d00c4","observation_id":"ee9f971b-3659-4da6-bac4-5c2b09363f28","resolution":{"observed_at":"2026-08-07T11:44:17.759419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-07T11:44:16.802766Z","title":"Denoising diffusion implicit models.arXiv preprint arXiv:2010.02502, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.802766Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:5c17e070cfa15bdf7adf171d4f7eb82fe10a4928f37ea5578fd81dc4210f6fa3","observation_id":"7826b16f-f504-4aeb-9264-6410d8cf1143","resolution":{"observed_at":"2026-08-07T11:44:16.802766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:16.818247Z","title":"Generative modeling by esti- mating gradients of the data distribution.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.818247Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:a9ee4aad0dfaef654ea2247d41953d78b520e9dd092cee974e5c68cd8cce0c34","observation_id":"fd6baa28-40e1-4588-a712-bc00a6088620","resolution":{"observed_at":"2026-08-07T11:44:16.818247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.10766","last_updated":"2018-05-21T05:26:01Z","snapshot_observed_at":"2026-08-04T05:51:55.347332Z","submitted_at":"2017-10-30T04:21:23Z","title":"PixelDefend: Leveraging Generative Models to Understand and Defend against Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.10766","snapshot_observed_at":"2026-08-07T11:44:16.832595Z","title":"Pixeldefend: Leveraging genera- tive models to understand and defend against adversarial ex- amples.arXiv preprint arXiv:1710.10766, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.832595Z"},"links":{"cited_paper":"/paper/1710.10766","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:c057681cae8923470067262a07b68b65bd4b252248ed95aabe2d39e1b3f16593","observation_id":"e28e2ba4-6cfb-44ec-849b-83638bc3d98d","resolution":{"observed_at":"2026-08-07T11:44:16.832595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.737174Z","title":"Diffused heads: Diffusion models beat gans on talking-face genera- tion","venue":null,"work_id":"7107e1e6-e21e-4421-8aae-444dc486495a","year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.852844Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:a1331e06be01d9c39cbc3a9034f56a13786179a1e0f64a27b5ad676d97b08814","observation_id":"c7d8a57a-8343-4f67-87ef-9fe21815a644","resolution":{"observed_at":"2026-08-07T11:44:17.741651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.724568Z","title":"Rethinking the up-sampling op- erations in cnn-based generative network for generalizable deepfake detection","venue":null,"work_id":"07776635-b08e-4d45-967f-1472e9a9dfd0","year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.874030Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:b17e2830b322e72077f2391de5fc8c6ffe691e82625cc1ed0fb2c8c035c3ee2f","observation_id":"cba54413-2f3e-4a61-a67e-10a52285b060","resolution":{"observed_at":"2026-08-07T11:44:17.729274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:16.890372Z","title":"Edtalk: Effi- cient disentanglement for emotional talking head synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.890372Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:fcb1b9f4bc665db6625d608ceddab27ce7d9e0f76e447103f3633e672a7630f4","observation_id":"aee0ff02-869a-414b-9273-33830ec2d131","resolution":{"observed_at":"2026-08-07T11:44:16.890372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17485","last_updated":"2024-08-08T03:48:38Z","snapshot_observed_at":"2026-07-06T17:36:11.854303Z","submitted_at":"2024-02-27T13:10:11Z","title":"EMO: Emote Portrait Alive -- Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17485","snapshot_observed_at":"2026-08-07T11:44:16.916279Z","title":"Emo: Emote portrait alive-generating expressive portrait videos with audio2video diffusion model under weak conditions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.916279Z"},"links":{"cited_paper":"/paper/2402.17485","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:8c393f74821d96c56c610bb7a4788a9026dcadbf1912513eff1c1fec85c1c9f5","observation_id":"ccf1a429-ef73-4c8b-b9d2-6d62c01ed81d","resolution":{"observed_at":"2026-08-07T11:44:16.916279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:16.934310Z","title":"Ex- ploring clip for assessing the look and feel of images","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.934310Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:3c43b41d15bcc6d733d63bebdafd0a2b3442427d85c407f472879b0103dfa25c","observation_id":"a4e59370-1d50-453d-a54d-3b23d7857a45","resolution":{"observed_at":"2026-08-07T11:44:16.934310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.594069Z","title":"One-shot free-view neural talking-head synthesis for video conferenc- ing","venue":null,"work_id":"aa16ed4e-7961-4068-8d0f-982d4a0abda5","year":2021},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.948476Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:e78609abe9669bc245e4f620b7ccdd300f0d205761689490b25d3b2b78697d7b","observation_id":"aa8fc364-08bf-4241-8544-7694cf8e495e","resolution":{"observed_at":"2026-08-07T11:44:17.597776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.582207Z","title":"Aniportrait: Audio-driven synthesis of photorealistic portrait animations,","venue":null,"work_id":"f1642d6b-64df-469a-95ac-872e21fb4b44","year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.967351Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:e2cd595240fe6972f331ba8a6afdb0d1873d42e1602bf73befcbe4da7a305bde","observation_id":"f7cf42ff-f0a2-4d7c-a59c-88ad8be42231","resolution":{"observed_at":"2026-08-07T11:44:17.586702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.570783Z","title":"Improving transferabil- ity of adversarial examples with input diversity","venue":null,"work_id":"edcb0d6b-f20c-40eb-8270-f61ec672b637","year":2019},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.982925Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:306cfa1ee7d142ddd6de20a79f45dd62a7eea83afe484683027ffa354b365ea8","observation_id":"0248316a-f22a-4822-9f5c-acd61dee426a","resolution":{"observed_at":"2026-08-07T11:44:17.575146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08801","last_updated":"2024-06-16T07:10:41Z","snapshot_observed_at":"2026-07-06T18:30:06.570612Z","submitted_at":"2024-06-13T04:33:20Z","title":"Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08801","snapshot_observed_at":"2026-08-07T11:44:16.996589Z","title":"Hallo: Hierarchical audio-driven vi- sual synthesis for portrait image animation.arXiv preprint arXiv:2406.08801, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.996589Z"},"links":{"cited_paper":"/paper/2406.08801","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:73a0af2a263c772e8839ccca91011f52115927eb75d623323453789dd7fb2e46","observation_id":"68bc8d76-28d7-45f1-b939-899835f93638","resolution":{"observed_at":"2026-08-07T11:44:16.996589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10667","last_updated":"2024-10-31T07:43:14Z","snapshot_observed_at":"2026-07-06T18:01:01.206270Z","submitted_at":"2024-04-16T15:43:22Z","title":"VASA-1: Lifelike Audio-Driven Talking Faces Generated in Real Time","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10667","snapshot_observed_at":"2026-08-07T11:44:17.012581Z","title":"Vasa-1: Lifelike audio-driven talking faces generated in real time.arXiv preprint arXiv:2404.10667,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.012581Z"},"links":{"cited_paper":"/paper/2404.10667","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:af05467cf4e66083d9e9e59a82e655c6d8f9341e50a59fc272628552b0b4587d","observation_id":"34c8d122-35c8-4e90-b54e-9de8adf46913","resolution":{"observed_at":"2026-08-07T11:44:17.012581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13320","last_updated":"2024-05-02T02:25:39Z","snapshot_observed_at":"2026-08-06T00:14:34.275386Z","submitted_at":"2024-04-20T08:28:43Z","title":"Pixel is a Barrier: Diffusion Models Are More Adversarially Robust Than We Think","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13320","snapshot_observed_at":"2026-08-07T11:44:17.028592Z","title":"Pixel is a barrier: Diffusion models are more adversarially robust than we think.arXiv preprint arXiv:2404.13320, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.028592Z"},"links":{"cited_paper":"/paper/2404.13320","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:b961e59d49892e63d1b494acb949b28588ea3bf053bd4e1bc8e1c4b747a8900c","observation_id":"be43f795-93c8-4783-bf3f-413cbd05f02c","resolution":{"observed_at":"2026-08-07T11:44:17.028592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.558980Z","title":"Toward effective protection against diffusion-based mimicry through score distillation","venue":null,"work_id":"073b7701-a06e-4e7d-9125-416916567652","year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.042481Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:85c97fc911a373882609e97c332efa2fe8848e407447394b6acec8a998eca3df","observation_id":"82c62d8a-0a4b-40f7-b751-26db7d2abb62","resolution":{"observed_at":"2026-08-07T11:44:17.562933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.059795Z","title":"Ucf: Uncovering common features for generalizable deep- fake detection","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.059795Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:1e24d5d2a6a7108609f95a0d3149b21382012c030ad804af9e17a8a252238b91","observation_id":"8ee30736-b2af-404c-9d49-fb8e71f34f05","resolution":{"observed_at":"2026-08-07T11:44:17.059795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.075846Z","title":"Adversar- ial purification with score-based generative models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.075846Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:3eb6448aa1a7319a0f8c107d5aeff30840a9ce73d4348b30f9da4ff5e55191e3","observation_id":"59b276bb-6347-43e4-b175-2ae797c9f777","resolution":{"observed_at":"2026-08-07T11:44:17.075846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.536035Z","title":"Sadtalker: Learning realistic 3d motion coefficients for stylized audio- driven single image talking face animation","venue":null,"work_id":"2da3611c-4b48-4293-b936-33b170f8ebea","year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.091451Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:896553eac600694e434e83ef11d808727b2a38858cc1d0b9f3f9848d170cdae6","observation_id":"756afe75-60e3-4b00-a98c-9b2d5a66f7dd","resolution":{"observed_at":"2026-08-07T11:44:17.539411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.523816Z","title":"To- wards large yet imperceptible adversarial image perturba- tions with perceptual color distance","venue":null,"work_id":"0cc9a2d0-bea6-4201-a14a-ce5a4efa6b30","year":2020},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.115243Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:5350f3f7e5d88290742010b19c63326284a87354b2aa523f775ea0cd2c44f88d","observation_id":"7ee583b4-6247-4430-b6f0-09e82a9087f2","resolution":{"observed_at":"2026-08-07T11:44:17.529436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.512711Z","title":null,"venue":null,"work_id":"f90b0c3a-6093-45f8-8d3b-fb22fc4e00c3","year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.136115Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:40131f2e6ade9dd8c0b173c3ff382b955d15a4e93b4b9dc1a5ba309c9b054f62","observation_id":"92a34921-f9a8-4a52-9c9f-c69149b0e033","resolution":{"observed_at":"2026-08-07T11:44:17.516457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.499676Z","title":"Talking face generation by adversarially disentan- gled audio-visual representation","venue":null,"work_id":"8080e48c-6426-4714-8b55-73783340ed49","year":2019},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.157059Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:14556a4455e041229de927a77ec01c15444b6f6207fb616770d570e8628b72c9","observation_id":"873fd666-a798-4191-bc72-f0e9bcc2d460","resolution":{"observed_at":"2026-08-07T11:44:17.504373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.192505Z","title":"Pose-controllable talking face generation by implicitly modularized audio-visual rep- resentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.192505Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:0070caf38a1f08c74b92c62bbe56d7e3806928afc1327197b75de1120eb5a000","observation_id":"df532a95-c954-44e7-88da-6643a132f24c","resolution":{"observed_at":"2026-08-07T11:44:17.192505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.480966Z","title":"DiffAudio","venue":null,"work_id":"c6c423ee-e947-480f-a267-2508f4cddece","year":2020},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.234857Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:80af0a8e7890bead2836b872f7a5dd93a9449595df79ed438c9c9ce5c7e00f5f","observation_id":"c0598462-9d37-4a45-b101-46000efbbea4","resolution":{"observed_at":"2026-08-07T11:44:17.485690Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:16.903319Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":416,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.903319Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:0a893e527428b0697e322300ce54460469169e9555b00fcc6317a730f4a20732","observation_id":"572ab673-e3d8-4ce2-bc7a-7f73a6245cb5","resolution":{"observed_at":"2026-08-07T11:44:16.903319Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","latest_version":1,"primary_category":"cs.GR","snapshot_observed_at":"2026-08-07T20:49:16.734644Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":31,"verified_exact":1,"verified_fuzzy":34},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 0 inbound Pith citation observations for arXiv:2506.01591."}