{"as_of":"2026-08-19T08:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3f69e9f07da218fb5b3243ae3694b8e45d807417b8272b287f57b797d7d30d92","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T12:58:33.169463Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.13656/citation-record","integrity":"/paper/2412.13656/integrity","json":"/paper/2412.13656/citation-record.json","paper":"/paper/2412.13656"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:32.726745Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.726745Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:e317c91987fdca583c7fd5eab7c871c2f28132da343f253004cdaf776774e0cd","observation_id":"403c8a28-b8e5-4ee2-85d8-49d88f22eaad","resolution":{"observed_at":"2026-08-11T12:58:32.726745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:34.311130Z","title":null,"venue":null,"work_id":"14c99b6a-4000-4aa4-8ce8-9443b9af3a46","year":2023},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.731120Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:ed3a901484bd7fc62bbf1d80917cbf2c9b1d02eeff6c65b3fc0891cd1ec7051e","observation_id":"e4a750e3-5fc3-44f3-8a14-a1a2f0b4760c","resolution":{"observed_at":"2026-08-11T12:58:34.315841Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:34.228014Z","title":"G.; Keutmann, M","venue":null,"work_id":"8b5f4a7d-2525-4df1-89d8-44e3599264bd","year":2014},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.734790Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:a2c91f4f1f4fdbbf60b32aa311b854f96247ac3495157c65bd0219735d6959d1","observation_id":"1e1c6748-9d4c-4e66-81ac-47f0e8319d42","resolution":{"observed_at":"2026-08-11T12:58:34.303795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:32.738851Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.738851Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:7521baebef758aecbe61c1c82631d44ce149b3c68912e674a1cd010316cfe789","observation_id":"7846c1dc-00fd-4bc0-b691-447cdb708b16","resolution":{"observed_at":"2026-08-11T12:58:32.738851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05720","last_updated":"2023-10-15T02:28:43Z","snapshot_observed_at":"2026-08-18T03:37:14.820120Z","submitted_at":"2023-10-09T13:45:21Z","title":"HyperLips: Hyper Control Lips with High Resolution Decoder for Talking Face Generation","version":3},"cited_work":{"arxiv_id":"2310.05720","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05720","snapshot_observed_at":"2026-08-11T12:58:33.288926Z","title":"HyperLips: Hyper Control Lips with High Resolution Decoder for Talking Face Generation","venue":"cs.CV","work_id":"fa34f207-462e-436a-bf6a-0723d99a6464","year":2023},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.743080Z"},"links":{"cited_paper":"/paper/2310.05720","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:a0c9c77861ee645a314955944b32973a28d35210a6e9fe9c192922830baf1c40","observation_id":"e9b94e7b-f332-46a4-b377-6c055221ff38","resolution":{"observed_at":"2026-08-11T12:58:33.319045Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:34.173248Z","title":null,"venue":null,"work_id":"64609e38-59f7-44a3-8ecc-1e7d5815b71a","year":2022},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.746693Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:ddc57cebb186a3f984029e59ba465e4e51a798384ffe059958f735301c6244b7","observation_id":"463fe4f7-85e2-4a53-9ad8-6271f9758b6d","resolution":{"observed_at":"2026-08-11T12:58:34.175620Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.05622","last_updated":"2018-06-27T01:49:17Z","snapshot_observed_at":"2026-08-15T02:39:00.334605Z","submitted_at":"2018-06-14T15:59:12Z","title":"VoxCeleb2: Deep Speaker Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.05622","snapshot_observed_at":"2026-08-11T12:58:32.750132Z","title":"S.; Nagrani, A.; and Zisserman, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.750132Z"},"links":{"cited_paper":"/paper/1806.05622","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:7bf7dd32272e047247bc622774d657108f0a14fbf280ec26916de28d8b0afdc6","observation_id":"3aaf091b-2135-4f5a-a934-fcc704ee6dc2","resolution":{"observed_at":"2026-08-11T12:58:32.750132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07397","last_updated":"2020-10-28T03:48:28Z","snapshot_observed_at":"2026-07-06T09:28:36.954658Z","submitted_at":"2020-06-12T18:15:55Z","title":"The DeepFake Detection Challenge (DFDC) Dataset","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.07397","snapshot_observed_at":"2026-08-11T12:58:32.754670Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.754670Z"},"links":{"cited_paper":"/paper/2006.07397","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:7fbf8106e53c69d70f8c8a2d53d02d15336892c30f5bdc7dc6cdcf6cb17dcc22","observation_id":"8a0c4934-9785-4660-9557-6cb85fd9e2c4","resolution":{"observed_at":"2026-08-11T12:58:32.754670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:34.165725Z","title":null,"venue":null,"work_id":"0aa1c83e-982d-4f68-a06a-40f1b836813c","year":2023},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.757538Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:45a5da8fb4dbd83086887f54d0f86d029426abf1e10dd0dc2d0cae5ba41a48ba","observation_id":"ce9a98d9-154e-479b-9c1b-7f3c9cab952a","resolution":{"observed_at":"2026-08-11T12:58:34.167896Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02813","last_updated":"2021-11-04T12:26:34Z","snapshot_observed_at":"2026-08-18T06:21:12.766256Z","submitted_at":"2021-11-04T12:26:34Z","title":"WaveFake: A Data Set to Facilitate Audio Deepfake Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02813","snapshot_observed_at":"2026-08-11T12:58:32.760603Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.760603Z"},"links":{"cited_paper":"/paper/2111.02813","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:6636eb81aec8c2df0e5216fc2f2b5a5617a4d49bc4280684af27bc7e2a69609a","observation_id":"e14c7676-0a0f-4aa0-9c9f-d48c448e4170","resolution":{"observed_at":"2026-08-11T12:58:32.760603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:34.131586Z","title":null,"venue":null,"work_id":"0cb66004-7a3e-4bf0-8813-0cc4888deb36","year":2020},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.763865Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:67df8142e89ed391adbfc6ea6634c596d45ce7b48140d4af21e20c79b9eb47f0","observation_id":"224b6877-53b0-436b-9c23-88c0d7e18695","resolution":{"observed_at":"2026-08-11T12:58:34.160836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.10196","last_updated":"2018-02-26T15:33:34Z","snapshot_observed_at":"2026-08-18T02:27:14.215000Z","submitted_at":"2017-10-27T15:28:35Z","title":"Progressive Growing of GANs for Improved Quality, Stability, and Variation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.10196","snapshot_observed_at":"2026-08-11T12:58:32.766621Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.766621Z"},"links":{"cited_paper":"/paper/1710.10196","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:fb3f56ec63f7cba7226f2da0c06cec8bd58b1edd3d5e21b882e19c1f19d02627","observation_id":"41923f72-fb0a-4100-a089-d81da050b851","resolution":{"observed_at":"2026-08-11T12:58:32.766621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.05080","last_updated":"2022-03-01T10:38:07Z","snapshot_observed_at":"2026-08-18T16:37:53.032175Z","submitted_at":"2021-08-11T07:49:36Z","title":"FakeAVCeleb: A Novel Audio-Video Multimodal Deepfake Dataset","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.05080","snapshot_observed_at":"2026-08-11T12:58:32.770164Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.770164Z"},"links":{"cited_paper":"/paper/2108.05080","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:5a8e0b24a7c253e2169342e355d1bbce0a37e5419cb2120b0eccfad070a54636","observation_id":"a111d174-b0d6-431c-a02d-88d010547b9b","resolution":{"observed_at":"2026-08-11T12:58:32.770164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:34.046226Z","title":null,"venue":null,"work_id":"7bfd9429-b2a1-4791-bc05-1ed7a7418a82","year":2018},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.774066Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:a1fbe8e9563085ca79257909cc2db90b373236722ed099f9f9d6ccff6c552ee3","observation_id":"a0b42f66-80c9-44c7-9705-dae50229b6ba","resolution":{"observed_at":"2026-08-11T12:58:34.048426Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:34.034741Z","title":null,"venue":null,"work_id":"939e6708-40b3-4224-a887-31f4dc4629ee","year":2021},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.796775Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:4b6f776bd17822a5bc4aef40076a60a4b548f91d0678c16f23cfc7139d60efb4","observation_id":"f2fd041e-0afd-4691-ad2d-ac3bd4fa81a5","resolution":{"observed_at":"2026-08-11T12:58:34.039618Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12308","last_updated":"2023-07-18T04:21:40Z","snapshot_observed_at":"2026-08-16T16:46:36.651415Z","submitted_at":"2022-07-12T13:27:21Z","title":"CFAD: A Chinese Dataset for Fake Audio Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12308","snapshot_observed_at":"2026-08-11T12:58:32.842376Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.842376Z"},"links":{"cited_paper":"/paper/2207.12308","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:1895f3e1e5024becf5e754373770c3104ebc4b4d8e96efac10c8c4ea722dc238","observation_id":"929eeb1c-7a50-4176-8305-82953fbc50fd","resolution":{"observed_at":"2026-08-11T12:58:32.842376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.921523Z","title":null,"venue":null,"work_id":"87a6a1fb-264a-4dc9-9ee5-10db5b5aece4","year":2021},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.949343Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:b86d96dbbddaf7a7c105e5a5e2d41cc7bf95716824d04912c4822aa93cb977ea","observation_id":"1f820b36-df29-4673-a818-99cb04079e44","resolution":{"observed_at":"2026-08-11T12:58:34.021234Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.912566Z","title":"T.; and Shrivastava, A","venue":null,"work_id":"023c74aa-d478-4f40-86c5-1f3877c5b1b0","year":2024},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.058067Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:f0a87f0bc14938124caa32e7adbefae0d86cca19a3df2270dfbeada72b87a402","observation_id":"b2e67851-a65b-4832-974b-9b1dedcd71e6","resolution":{"observed_at":"2026-08-11T12:58:33.916369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.08612","last_updated":"2018-05-30T06:52:06Z","snapshot_observed_at":"2026-08-18T23:33:12.915054Z","submitted_at":"2017-06-26T21:42:27Z","title":"VoxCeleb: a large-scale speaker identification dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.08612","snapshot_observed_at":"2026-08-11T12:58:33.087393Z","title":"S.; and Zisserman, A","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.087393Z"},"links":{"cited_paper":"/paper/1706.08612","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:18848eb4ae448011d04fa63e73a78aa4af2481dd9c1edca2ec7008351fd36236","observation_id":"c71870c2-b0b4-49e2-bdd4-012cd5663604","resolution":{"observed_at":"2026-08-11T12:58:33.087393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.822543Z","title":null,"venue":null,"work_id":"2a22e6fc-6933-483c-9202-6718fc18dea1","year":2023},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.092166Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:c565e754fe023d817776742b64b9bc95a17fef1aaa36c10fc4ce742010f6532e","observation_id":"ac1404db-fb00-4d6d-b57f-c1532438430a","resolution":{"observed_at":"2026-08-11T12:58:33.905285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.702977Z","title":null,"venue":null,"work_id":"e699f547-80a2-4b1a-9b25-4cab0f1adf99","year":2015},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.095673Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:1282fa93db098a46c6b8d2b45e1e5d71725e70eb672a9ca5dd1223283ebfd9d6","observation_id":"b299413d-d507-4d0b-80ea-b8b6ce45fe84","resolution":{"observed_at":"2026-08-11T12:58:33.746872Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.649797Z","title":null,"venue":null,"work_id":"c45c9c97-efee-48ac-a221-9559f8b789da","year":2024},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.098394Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:fe46c1487327d7a332bfcda4a8fe15a534252b990714b5e07742c02155239ea8","observation_id":"5ec34e97-3ccb-42af-9e2a-0839bc36e80d","resolution":{"observed_at":"2026-08-11T12:58:33.652381Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.640590Z","title":null,"venue":null,"work_id":"003168d2-6603-47dc-b72f-02b15a207210","year":2024},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.101826Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:3a5d545cd483820d9904e3512b12630114141ea417050828f1c222a6e6e2c949","observation_id":"df2943c6-42a4-4dc8-b103-b78a2b3e5c73","resolution":{"observed_at":"2026-08-11T12:58:33.643240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.632315Z","title":null,"venue":null,"work_id":"8e682244-08d1-40c0-bea0-fe89a776af72","year":2020},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.105237Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:44fa9a75c44761c3627b0571fa91de4197507d19e44172aa77126b62b515d65e","observation_id":"b533f3af-5569-453f-9d94-222f2fe5ea96","resolution":{"observed_at":"2026-08-11T12:58:33.635300Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.623036Z","title":null,"venue":null,"work_id":"2879844e-5eb1-41b7-a78d-2b3e57d227f4","year":2019},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.107789Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:948e7f600d85365589b31a481ab9f4dfe804178708de8f6a684e70ef36147253","observation_id":"0221a3eb-a05e-4a99-9500-b57d43290051","resolution":{"observed_at":"2026-08-11T12:58:33.625935Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.109754Z","title":"R.; Cogswell, M.; Das, A.; Vedantam, R.; Parikh, D.; and Batra, D","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.109754Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:beab1c63b7ae42edb83318a5dc77f551c63cbebb0ade0d43933bbbefea98b1f0","observation_id":"7a5647f4-aeb6-48c5-af77-b3e9b20e4efb","resolution":{"observed_at":"2026-08-11T12:58:33.109754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.609843Z","title":null,"venue":null,"work_id":"0085eb3e-d272-42ca-abf5-296841e77683","year":2017},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.112658Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:716b2646e41b1c41c4b8181bd3997af46be7342b1034b7c1061ac11e3695ba08","observation_id":"428bf39a-9ec4-4056-8956-d68cde785870","resolution":{"observed_at":"2026-08-11T12:58:33.612721Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.600536Z","title":null,"venue":null,"work_id":"4c2634ad-b1b2-421e-a407-b602c11030d5","year":2023},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.115653Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:a66d9c1453da5d91710f971ff89dc0b6f2311066b8c01a5a9493e97ab860c334","observation_id":"d83c75ca-9b7a-44ee-9499-b6037ad4b83b","resolution":{"observed_at":"2026-08-11T12:58:33.604187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07240","last_updated":"2024-03-12T01:28:00Z","snapshot_observed_at":"2026-08-16T14:10:45.786855Z","submitted_at":"2024-03-12T01:28:00Z","title":"Frequency-Aware Deepfake Detection: Improving Generalizability through Frequency Space Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07240","snapshot_observed_at":"2026-08-11T12:58:33.118855Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.118855Z"},"links":{"cited_paper":"/paper/2403.07240","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:656d603304191f7688878221e9278754af212dfdaa628f3f67c417d6d5a3f6d4","observation_id":"f96ceec8-2e51-4178-a052-ba7c3e2315a1","resolution":{"observed_at":"2026-08-11T12:58:33.118855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05441","last_updated":"2019-04-14T11:38:32Z","snapshot_observed_at":"2026-08-15T22:10:10.299222Z","submitted_at":"2019-04-09T15:12:52Z","title":"ASVspoof 2019: Future Horizons in Spoofed and Fake Audio Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.05441","snapshot_observed_at":"2026-08-11T12:58:33.122219Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.122219Z"},"links":{"cited_paper":"/paper/1904.05441","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:5667e5628f01781c4448813db3546c4661c5d7d4e23f134eb320e9c700f8f483","observation_id":"e0ea3271-3958-44b9-960f-17e7bd278645","resolution":{"observed_at":"2026-08-11T12:58:33.122219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.517427Z","title":null,"venue":null,"work_id":"d7529099-5571-467f-900e-5eb40d3b49f1","year":2021},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.124874Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:ca3c1eea57a396c60dadc72753de9e81333a271ad29d61a156245a9cff66833c","observation_id":"b7ba39f8-eabe-436d-8ed6-b0c4048f39ce","resolution":{"observed_at":"2026-08-11T12:58:33.594301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.403702Z","title":null,"venue":null,"work_id":"27ff1413-f372-4741-96f2-2539789f90c1","year":2020},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.127852Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:2eb80a229730d20007b9cbadff6a37b3b5b86bf309c1020c079011acfea8db7c","observation_id":"6b42ce81-f0cd-45b2-a359-1c1e4f2b92a2","resolution":{"observed_at":"2026-08-11T12:58:33.462051Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14974","last_updated":"2024-03-22T06:04:37Z","snapshot_observed_at":"2026-08-16T14:07:27.167214Z","submitted_at":"2024-03-22T06:04:37Z","title":"AVT2-DWF: Improving Deepfake Detection with Audio-Visual Fusion and Dynamic Weighting Strategies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14974","snapshot_observed_at":"2026-08-11T12:58:33.130508Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.130508Z"},"links":{"cited_paper":"/paper/2403.14974","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:2c4e89e4c246676c66fa9ca665a9ca3b10a36342a7bc82a4e04b20d1bb111896","observation_id":"9c3c2a89-f029-45f4-a2c7-b637d50fe8c4","resolution":{"observed_at":"2026-08-11T12:58:33.130508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.379219Z","title":null,"venue":null,"work_id":"7734f1c2-2d65-428c-982d-b0c1955dd65d","year":2023},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.133652Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:83f44b656544dde973384a7bfb5482fe64cf60c5ebd5340a7a411828db43d8a1","observation_id":"f72daac4-d45c-4df0-b1b8-cf27a7fb32e9","resolution":{"observed_at":"2026-08-11T12:58:33.381786Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.372522Z","title":null,"venue":null,"work_id":"bbe76525-60bb-4652-be92-e72f2cbb87dc","year":2024},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.136370Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:d5f628b43e056b9ae14693d81fc9ca53a2b25073260a239965b0ed7493543a51","observation_id":"f40e84e7-500e-47f4-bfd9-6762f66614df","resolution":{"observed_at":"2026-08-11T12:58:33.375035Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.364262Z","title":null,"venue":null,"work_id":"4732962e-afbb-449e-883c-c80f49d46129","year":2023},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.139244Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:c65a48a7b35b73740ed9ee5ac60fa5252d9e261d13a120979b61e4924d808166","observation_id":"409b76a2-89c6-4f17-8256-9ce4a43ab176","resolution":{"observed_at":"2026-08-11T12:58:33.366969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.141446Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.141446Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:c884036b462b8d68cb570843b3b761599241194c5534a53cfc6001594a90019f","observation_id":"98b8875c-5ef4-45e7-9770-9d9f7ec523b1","resolution":{"observed_at":"2026-08-11T12:58:33.141446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.352025Z","title":null,"venue":null,"work_id":"39cc8e4c-7102-4057-98de-bf85d8ff80ad","year":2023},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.144345Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:bca97ba028e406be6488d01b35c843ab4af3a4eb2c166ad096a6dc6633cc376f","observation_id":"6d459e54-d84d-4ebe-894e-9d513b7935af","resolution":{"observed_at":"2026-08-11T12:58:33.354699Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.343050Z","title":null,"venue":null,"work_id":"8de56d13-91f8-49db-848c-e2269ac64ea9","year":2021},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.147162Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:1a85b538ce4a3ab9ea50a4306888e6be94d55b43cac653177edaa0406546f333","observation_id":"c63e7335-4ad9-4cf9-9e4e-697d66bb7261","resolution":{"observed_at":"2026-08-11T12:58:33.345864Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.335219Z","title":null,"venue":null,"work_id":"482cd6b8-f2e8-4de3-9262-9faf6e861a91","year":2021},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.149714Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:17631ab47c9c6c8098be39fa6f775b1776dcd992a54551d9c313b5f6b01ffb1f","observation_id":"50af1a8a-7c72-4b85-bb84-bdcd1b9545a1","resolution":{"observed_at":"2026-08-11T12:58:33.337364Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.152805Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.152805Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:fba1d00f23164693a8a623921b97496f336171f3c5b7663c5793b986c410d924","observation_id":"c85ca2d0-33e9-409c-9df8-0e8a821d3ba8","resolution":{"observed_at":"2026-08-11T12:58:33.152805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.169463Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.169463Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:e234546e07dbbb9066cf52b283041d3190373027a629cd16a89a425a811940b9","observation_id":"b1bc5ba6-f787-4db2-94fb-6be809e8f40b","resolution":{"observed_at":"2026-08-11T12:58:33.169463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2412.13656."}