{"as_of":"2026-08-08T06:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:988ceb4ef3bb1563683c259290df6a6e15d408864019397bbc5f05893c9b85db","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:18:40.860197Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.05851/citation-record","integrity":"/paper/2506.05851/integrity","json":"/paper/2506.05851/citation-record.json","paper":"/paper/2506.05851"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:34.040956Z","title":"Senior, Oriol Vinyals, and Andrew Zisser- man","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:34.040956Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:eb9e465c6a4522b333daddadaeeb1fe01b5921f84eb86eb7f759dbdfd6214d92","observation_id":"137a5580-54bc-46c3-a17b-01fa312a7735","resolution":{"observed_at":"2026-08-07T10:18:34.040956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:49.982706Z","title":"Detecting deep-fake videos from phoneme-viseme mismatches","venue":null,"work_id":"2077c925-c949-47b9-b637-ba4ce1df58bc","year":2020},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:34.144548Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:df61338102ef2ca68c47f4746a4489a0c5a83c364b52609e87cfbf7ba9502fb6","observation_id":"391d8aed-ff5c-4f69-9c05-6ad947eb7f4b","resolution":{"observed_at":"2026-08-07T10:18:50.077697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05366","last_updated":"2026-04-06T23:43:02Z","snapshot_observed_at":"2026-07-06T18:59:05.329809Z","submitted_at":"2024-08-09T22:29:43Z","title":"The DeepSpeak Dataset","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05366","snapshot_observed_at":"2026-08-07T10:18:34.419801Z","title":"Deepspeak dataset v1.0.CoRR, abs/2408.05366, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:34.419801Z"},"links":{"cited_paper":"/paper/2408.05366","citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:52183e19053614cee87b282ac063afd77deb7d527cd6295c1541a8a62420f6bd","observation_id":"c5ab2175-98ce-4bf8-9ea2-f91fcf616805","resolution":{"observed_at":"2026-08-07T10:18:34.419801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:49.740956Z","title":"Lost in translation: Lip-sync deepfake detection from audio- video mismatch","venue":null,"work_id":"65a2a583-7db1-44a6-a838-934c019b2aa0","year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:34.518048Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:c72dfe290cb14e010ed99acb248dc4a5eebf2987a627837b2f9f12f57788e09a","observation_id":"71e7f34b-180b-4746-9d74-fb0bd3a3b8a2","resolution":{"observed_at":"2026-08-07T10:18:49.846823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:49.436415Z","title":"Circumventing shortcuts in audio-visual deepfake detection datasets with unsupervised learning.To appear in CVPR, 2025","venue":null,"work_id":"8f6a531c-6891-4129-ba5b-50ff5aaef88a","year":2025},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:34.627772Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:a1fca49f1362919ba09a760ca93102647f3940e3e45077b44713bfc4366eff44","observation_id":"11a88e2c-7f21-4cc4-b4a7-e90c760db9d6","resolution":{"observed_at":"2026-08-07T10:18:49.569037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:49.078150Z","title":"Do you really mean that? content driven audio-visual deepfake dataset and multimodal method for temporal forgery localization","venue":null,"work_id":"c15b4a91-adf0-4481-892b-1e5ed5ee2e5e","year":null},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:34.744641Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:642a36138d69e3862f322edd4a29231a2194ccdb9e8a93d3c9b17d64fefcdb92","observation_id":"fb4dd59d-341d-4699-acff-e1bb683953ad","resolution":{"observed_at":"2026-08-07T10:18:49.251817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:34.900423Z","title":"Av-deepfake1m: A large-scale llm-driven audio-visual deepfake dataset","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:34.900423Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:d1e39dfd0b518200aaa6634ed29250ccf05624701edb26a82bdf3676a14f31f3","observation_id":"89acdd4a-85c0-4e88-8425-db31d6137f7d","resolution":{"observed_at":"2026-08-07T10:18:34.900423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:35.020180Z","title":"Trusted media challenge dataset and user study","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:35.020180Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:b9f439e090254cadba97ecb131aa90e8975bc997db9f7d52e8a17169672bc40c","observation_id":"b438945d-eb13-4c3f-8af5-080004ef07f9","resolution":{"observed_at":"2026-08-07T10:18:35.020180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:48.822880Z","title":"V oice-face homogeneity tells deepfake.ACM Trans","venue":null,"work_id":"060bd670-03f8-47c0-8ac5-1d34e872d7db","year":null},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:35.133827Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:2038f3252b8a012a72a24d9659be8884d02dc4a100f52379c346d67652ebf23d","observation_id":"3c8b1e7d-e1fe-416b-8a71-9616440fd572","resolution":{"observed_at":"2026-08-07T10:18:48.972000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:35.408685Z","title":"Videoretalking: Audio-based lip synchronization for talking head video editing in the wild","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:35.408685Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:07aa43245a132b1235c8be17781846a12c2e298a3f8b3c9fd952748aef6db23b","observation_id":"3806f93c-6950-4cbc-ae85-995f0582eae6","resolution":{"observed_at":"2026-08-07T10:18:35.408685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:35.527022Z","title":"Not made for each other- audio-visual dissonance-based deepfake detection and localization","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:35.527022Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:13c2b30608dab37109ed66a595cd892bb41894ae9a6bcf270ec15bd8ae4f9e2b","observation_id":"3fba45a1-227d-4c02-a7cb-0a40b8dc8933","resolution":{"observed_at":"2026-08-07T10:18:35.527022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:48.529368Z","title":null,"venue":null,"work_id":"01a053e7-8113-4d82-8d9e-58fc39dee51a","year":2018},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:35.686358Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:604778c0a55b5218a048cb0213ae24d44db43a70b8fa3804301aeb05c6b86fc8","observation_id":"1ee450fe-2506-44c7-aeb1-4ecdcaea66cb","resolution":{"observed_at":"2026-08-07T10:18:48.657179Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.08854","last_updated":"2019-10-23T18:47:35Z","snapshot_observed_at":"2026-08-06T07:27:19.098848Z","submitted_at":"2019-10-19T22:35:52Z","title":"The Deepfake Detection Challenge (DFDC) Preview Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.08854","snapshot_observed_at":"2026-08-07T10:18:35.823824Z","title":"The deepfake detection challenge (DFDC) preview dataset.CoRR, abs/1910.08854, 2019","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:35.823824Z"},"links":{"cited_paper":"/paper/1910.08854","citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:d733ab1025d8b8ec22080e7dfe61aee9d98fbddbdb9b363af983323b6b71392f","observation_id":"4fb05eb3-63b2-4f99-94dd-b2250659033f","resolution":{"observed_at":"2026-08-07T10:18:35.823824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:48.192474Z","title":"ElevenLabs: Free Text to Speech & AI Voice Generator","venue":null,"work_id":"b27aa18d-38de-4d24-8b05-0a2f0052b9c8","year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:35.991387Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:ffb342eb05f222d4074812be89e3f2801fb05c8efc48d8eab986d100f2a61521","observation_id":"550595e7-6821-4d0a-9178-d31a11ef109e","resolution":{"observed_at":"2026-08-07T10:18:48.367499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:47.880364Z","title":"Self-supervised video forensics by audio-visual anomaly detection","venue":null,"work_id":"19ec73ae-1b82-409a-9aef-dea79416b198","year":2023},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:36.123870Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:4a0b7593f986028fc0805863a833fe353c404d3da53ecd1bef984094b01f35c6","observation_id":"1e426f45-ccae-4559-b885-cdc6124083b4","resolution":{"observed_at":"2026-08-07T10:18:48.009313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:36.280656Z","title":null,"venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:36.280656Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:b1bdeb001eff1636966e2f1e9d668b0c0a9d83141c9906488d83ed8db8c2ffcf","observation_id":"7bf25df6-d26f-4dbf-8e19-cf8922e84231","resolution":{"observed_at":"2026-08-07T10:18:36.280656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:36.414438Z","title":"Spatiotemporal inconsistency learning for deepfake video detection","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:36.414438Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:bf5ea347d9f093c2b509e207f1dc3749ffda99aa30c37a1d68f9eceeb10e13fc","observation_id":"44130256-47ba-405b-867d-34fe04e45508","resolution":{"observed_at":"2026-08-07T10:18:36.414438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.01453","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:43.095812Z","title":"Leveraging real talking faces via self-supervision for robust forgery detection","venue":null,"work_id":"e9bb8ae2-b38c-4a14-a6bb-ee47478b6ac7","year":2022},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:36.727650Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:429a5843fd742a01a6695dceb8cea73afe021f7eec44854b8f38d893faf56292","observation_id":"2287872a-fb16-4e1a-b5a7-56a913bb8864","resolution":{"observed_at":"2026-08-07T10:18:43.182725Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:36.840206Z","title":"Forgerynet: A versatile benchmark for comprehensive forgery analysis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:36.840206Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:2d91fe2060be01758a37a9f577b6a604874e793e99017569e2a784d67769b023","observation_id":"f2571ef6-a702-4a8b-b719-ca962c4465d2","resolution":{"observed_at":"2026-08-07T10:18:36.840206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08838","last_updated":"2024-05-14T06:40:05Z","snapshot_observed_at":"2026-07-06T18:14:20.889736Z","submitted_at":"2024-05-14T06:40:05Z","title":"PolyGlotFake: A Novel Multilingual and Multimodal DeepFake Dataset","version":1},"cited_work":{"arxiv_id":"2405.08838","doi":"10.48550/arxiv.2405.08838","metadata_source":"pith","pith_arxiv_id":"2405.08838","snapshot_observed_at":"2026-08-07T18:16:16.850658Z","title":"PolyGlotFake: A Novel Multilingual and Multimodal DeepFake Dataset","venue":"cs.SD","work_id":"afac1827-921c-4237-ac47-d888f66a373f","year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:36.977932Z"},"links":{"cited_paper":"/paper/2405.08838","citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:40591b64975d977e81ba8fc824895a6c9d9d5f2e307b54ea919995f7a5188bb1","observation_id":"5cec82e8-4ef9-4aab-8b1c-b9180840ec97","resolution":{"observed_at":"2026-08-07T10:18:41.297397Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:47.583973Z","title":"Deepfakes and their impact on society, Feb 2024","venue":null,"work_id":"69590cd8-5646-4cd4-8749-460e3ea1bcd5","year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:37.036609Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:5c35a43cb33d92143906b09d4e68151f4b35d74df49ecada6d4432955a19a61d","observation_id":"e965ea21-0790-4c61-b9ad-22ab694cd5e3","resolution":{"observed_at":"2026-08-07T10:18:47.692602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:47.218670Z","title":"Weiss, Quan Wang, Jonathan Shen, Fei Ren, Zhifeng Chen, Patrick Nguyen, Ruoming Pang, Ignacio López-Moreno, and Yonghui Wu","venue":null,"work_id":"dcff0741-15ea-4858-abf8-a377cbdc1771","year":2018},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:37.185765Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:c2a3fd025bc00cd5e10922d98d982987e4b43f2059390b4012e1b6aca317f4a7","observation_id":"1568a3ee-c208-45b7-8c42-949c5ea49ee4","resolution":{"observed_at":"2026-08-07T10:18:47.378731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:46.936505Z","title":"Revisiting generalizability in deepfake detection: Improving metrics and stabilizing transfer","venue":null,"work_id":"2ab6d60b-3e67-4f6e-a8fc-626df1586cc5","year":2023},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:37.340240Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:96e678b29ca63d845963b9f4c4a582b136f668b7438aa2037824b5bef3f512e3","observation_id":"0c80c111-ad3e-4630-9443-2e89293ce9d5","resolution":{"observed_at":"2026-08-07T10:18:47.093958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:46.617036Z","title":null,"venue":null,"work_id":"7e35239d-fa09-4ae9-aa9a-cb7dfcb60a4f","year":2021},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:37.462225Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:071205d44d354721784925f8f2d47b19ba9bf6f12422e8aacfca3114c714cebc","observation_id":"9b2ffe8b-0cc3-4926-bd6d-db2fb6322b15","resolution":{"observed_at":"2026-08-07T10:18:46.748930Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:37.662506Z","title":"Fast face-swap using con- volutional neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:37.662506Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:52a86f87ab623b46390ef8753cd23119114f5dd07d1730027474074d804713a7","observation_id":"43e10c6a-d2d0-44a2-95c9-2cf90bcadf9c","resolution":{"observed_at":"2026-08-07T10:18:37.662506Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10193","last_updated":"2025-04-11T06:56:20Z","snapshot_observed_at":"2026-08-02T18:41:47.891481Z","submitted_at":"2024-11-15T13:47:33Z","title":"DiMoDif: Discourse Modality-information Differentiation for Audio-visual Deepfake Detection and Localization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10193","snapshot_observed_at":"2026-08-07T10:18:37.830717Z","title":"Dimodif: Discourse modality-information differen- tiation for audio-visual deepfake detection and localization.CoRR, abs/2411.10193, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:37.830717Z"},"links":{"cited_paper":"/paper/2411.10193","citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:f37918e782eada587d55d59d3887c65bb9a711a50d40bb1e1c38f8ec4de5d84a","observation_id":"96394362-d0dc-478a-bf7d-d7b9b080d66c","resolution":{"observed_at":"2026-08-07T10:18:37.830717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:46.289272Z","title":"Kodf: A large-scale korean deepfake detection dataset","venue":null,"work_id":"abdcf3c3-e44a-4ef9-adf3-17d9f27e73a5","year":2021},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:37.994764Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:a507e84b5a0e4a8865eb0d602b847992b33ab1bdab78d5a5a707d2564ab03740","observation_id":"03a3f80c-a08a-454c-894f-1b5f31d40cbd","resolution":{"observed_at":"2026-08-07T10:18:46.437415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:46.113782Z","title":"Speechforensics: Audio-visual speech represen- tation learning for face forgery detection","venue":null,"work_id":"6fb3f5c1-30c9-4d28-ab16-4df5e4f9005c","year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:38.474126Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:a8dbafb80a9ed031b949a382e5b587d5227971617e1ef02eb094867505c5f542","observation_id":"e3fce336-49f9-420d-8d68-205964c00070","resolution":{"observed_at":"2026-08-07T10:18:46.188229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:45.881902Z","title":"Lips are lying: Spotting the temporal inconsistency between audio and visual in lip-syncing deepfakes","venue":null,"work_id":"ef17498b-d5b4-4bff-bb08-37ff01974f61","year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:38.579454Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:9db10013e73bcdd764a3ff5f464b294e5ca60541522a6a6cce8350a59c74ec20","observation_id":"ae3834d0-e49d-47fb-ae37-6eba138d6cf4","resolution":{"observed_at":"2026-08-07T10:18:45.975597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:45.625498Z","title":"Emotions don’t lie: An audio-visual deepfake detection method using affective cues","venue":null,"work_id":"0cec5649-8dd0-4976-93ec-8a86591a6732","year":2020},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:38.755159Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:3baad1c777c259472bc0bdf92d1838590c04da33a7bbd7e4cdb7c8ab58c07c84","observation_id":"4bf0d71d-cfb8-4fb8-85f6-3ba254e11c2b","resolution":{"observed_at":"2026-08-07T10:18:45.762206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.00939","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:42.744000Z","title":"Df-platter: Multi-face heterogeneous deepfake dataset","venue":null,"work_id":"78c53414-9ba7-4d3a-b2cc-83efa991043f","year":2023},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:38.952692Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:6bdfd72d19f82265c35d761a25fe2de5eba1a52f186c0082fa48de73d8f0343a","observation_id":"754a0db5-4509-4c03-89e3-e11c5c2b8c0c","resolution":{"observed_at":"2026-08-07T10:18:42.849268Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:39.097410Z","title":"BYOL for audio: Self-supervised learning for general-purpose audio representation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:39.097410Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:95327495dcbe1ccd1f162c23ed7de2026a8b2c47bcdca5f2ccad393d593942a7","observation_id":"e0742caa-fdfb-4b25-8e85-ea301dcf5c9d","resolution":{"observed_at":"2026-08-07T10:18:39.097410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:39.234661Z","title":"FSGAN: subject agnostic face swapping and reenactment","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:39.234661Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:3bd02ea4fb1c2a0792f72277fe8eee5293f6a8fff8efe184fd1241aedca018f0","observation_id":"e89a7697-22d6-4497-af9b-48f585966a2a","resolution":{"observed_at":"2026-08-07T10:18:39.234661Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:39.343411Z","title":"A VFF: audio-visual feature fusion for video deep- fake detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:39.343411Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:b81e4fc78e64e54d50404f51c891aac357de8fad80a2ce7f024db148a2e4f07c","observation_id":"e9b7e56b-75c3-4e75-b4d8-6b72b3b0171d","resolution":{"observed_at":"2026-08-07T10:18:39.343411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:39.434600Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:39.434600Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:6dd87ade38f1470b68754a7e593003833937ecb0ba3973fd7805dbad4d794540","observation_id":"8525d7f7-0d25-4e89-b38a-3f67fc0098d1","resolution":{"observed_at":"2026-08-07T10:18:39.434600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:39.576824Z","title":"Multimodaltrace: Deepfake detection using audiovisual representation learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:39.576824Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:948dd66c18fb1f983485c5f3a2bde6f4cbcf5168ebeb1f4de2d633b91c5b0a6f","observation_id":"228e61de-e17a-469f-aece-520079c1ad5f","resolution":{"observed_at":"2026-08-07T10:18:39.576824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:39.675418Z","title":"Faceforensics++: Learning to detect manipulated facial images","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:39.675418Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:66efeac151eeb6247c035378683f0d08f65ef69afebcb4a5d4b5d8099fba18b2","observation_id":"51baf870-57bd-40ca-85e3-30826a359ac7","resolution":{"observed_at":"2026-08-07T10:18:39.675418Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:45.437086Z","title":"Facefusion.https://github.com/facefusion/facefusion, 2024","venue":null,"work_id":"b0534096-f522-4305-99c2-7a4e38d70517","year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:39.799085Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:3903e482c8801a0e173792eff0725a080bbf46a0b45256dcacc1170fa4d42985","observation_id":"f4c909d7-ae70-47ab-b9d4-d9b9e97e3685","resolution":{"observed_at":"2026-08-07T10:18:45.539321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7947.36080","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:42.026493Z","title":null,"venue":null,"work_id":"eb26d4a4-6246-4176-bc15-ef1322f0f489","year":2023},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:39.881395Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:500740be79100ec34e2960d4cc5c0f1f9a44491984f6d633bf7d5996fede76b6","observation_id":"c60b9fc1-9ce8-4a09-8700-f2a8ba2e0276","resolution":{"observed_at":"2026-08-07T10:18:42.107402Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17088","last_updated":"2024-06-20T20:24:59Z","snapshot_observed_at":"2026-07-06T16:53:58.875152Z","submitted_at":"2023-11-28T03:28:19Z","title":"Unsupervised Multimodal Deepfake Detection Using Intra- and Cross-Modal Inconsistencies","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17088","snapshot_observed_at":"2026-08-07T10:18:39.977883Z","title":"Unsupervised multi- modal deepfake detection using intra- and cross-modal inconsistencies.CoRR, abs/2311.17088,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:39.977883Z"},"links":{"cited_paper":"/paper/2311.17088","citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:93d18e83d87d695dd9a827d0ee64d3c8ae812299d5e7c4ac5650dd56f1c141d3","observation_id":"dc4fa2ff-1c45-4880-b240-6d4a3d230ae6","resolution":{"observed_at":"2026-08-07T10:18:39.977883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:40.238556Z","title":"A closer look at spatiotemporal convolutions for action recognition","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.238556Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:8214ccb835562835a37e003f11a4b94160b1f14548e7185cff932e318ea3e8e0","observation_id":"b9f2c399-abe0-43e3-946b-4c0adcea4a2e","resolution":{"observed_at":"2026-08-07T10:18:40.238556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-43153-1","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":"Deepfakes audio detection leveraging audio spectrogram and convolutional neural networks","venue":"Lecture notes in computer science","work_id":"f472118b-caf0-4ee8-9697-e7478d368c11","year":2023},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.294725Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:c4147404c8ad0a23207537f3e86c549a2b6186910f32b39156cd81e16149f0aa","observation_id":"bddfc92f-ec1d-4dd9-9fed-1d30545f29c8","resolution":{"observed_at":"2026-08-07T10:18:40.996484Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:45.145379Z","title":"Abc-capsnet: Attention based cascaded capsule network for audio deepfake detection","venue":null,"work_id":"c9694a0d-f415-4131-82be-12e89a2fd29d","year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.385598Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:71896a7483992494c279c85bff86d385052afa73e5f74ad464537f9843e12486","observation_id":"a83e6824-73e2-4ef0-a2d9-82b2a48369c1","resolution":{"observed_at":"2026-08-07T10:18:45.304466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:40.494965Z","title":"Audio deepfake detection system with neural stitching for ADD 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.494965Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:4637dada1c9eaabbe0267e42c49646ae2aebc989117264c92d55f542b6564dc8","observation_id":"46def09e-f4c3-495b-9cc4-e5e586cbecd5","resolution":{"observed_at":"2026-08-07T10:18:40.494965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:40.532283Z","title":"Avoid-df: Audio-visual joint learning for detecting deepfake.IEEE Trans","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.532283Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:23011b96667e66bbdd790a0614dd9b685dc86f6775dc679721398a762faac41b","observation_id":"72324672-143b-4265-98a6-51a2a96795e4","resolution":{"observed_at":"2026-08-07T10:18:40.532283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:44.841128Z","title":"Joint face detection and alignment using multitask cascaded convolutional networks.IEEE signal processing letters, 23(10): 1499–1503, 2016","venue":null,"work_id":"5e506304-b9fd-49e4-86af-c9aecd8bf576","year":2016},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.621662Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:3ea3573e03ef9f9f3359816d8f3a3a2f2106244d2ddf26bcc978edc062018528","observation_id":"15d6c69a-8c75-46c0-81b1-fc7b71a009cd","resolution":{"observed_at":"2026-08-07T10:18:45.002570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:44.574952Z","title":"Exploring temporal coherence for more general video face forgery detection","venue":null,"work_id":"e5ec08b6-2cfb-4868-91d5-14a0242e7213","year":2021},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.697362Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:1bee255bd82ccfaa43e66bd38c76ecf5ef69447dc81dfada4a0fb5cc3accbe7d","observation_id":"5bd5cf4a-11af-4f7a-bd31-9ee4101235b5","resolution":{"observed_at":"2026-08-07T10:18:44.715333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:44.278803Z","title":null,"venue":null,"work_id":"66715c0d-358c-4281-b00d-fa924e88ae35","year":2022},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.766574Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:3fe9a15c113c781f64da75e38e28bb3de93a18392231ef97698c990173d21ec0","observation_id":"228876f4-7a32-4c66-9459-21f024b91279","resolution":{"observed_at":"2026-08-07T10:18:44.419252Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:44.065910Z","title":"real”/“fake","venue":null,"work_id":"15b8adad-8d65-4cf5-b706-39c9c74ae7b8","year":2021},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.860197Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:fb81879c437e0d271c0d08353bdfcf9663f24110f50c0e2f00f7d73367402e0f","observation_id":"c71c2684-7bc1-4615-b752-e8678f7d6328","resolution":{"observed_at":"2026-08-07T10:18:44.136851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00214","last_updated":"2020-05-20T17:40:28Z","snapshot_observed_at":"2026-07-06T09:16:45.827004Z","submitted_at":"2020-05-01T04:17:14Z","title":"The AVA-Kinetics Localized Human Actions Video Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00214","snapshot_observed_at":"2026-08-07T10:18:38.362189Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:38.362189Z"},"links":{"cited_paper":"/paper/2005.00214","citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:a6218abb67f6a0cc47669128819b8ad8627ca4f33a76fd372d8c30b8f7c0700d","observation_id":"86d7a5a5-92a7-47e3-bac2-c46bd06143ca","resolution":{"observed_at":"2026-08-07T10:18:38.362189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17088","last_updated":"2024-06-20T20:24:59Z","snapshot_observed_at":"2026-07-06T16:53:58.875152Z","submitted_at":"2023-11-28T03:28:19Z","title":"Unsupervised Multimodal Deepfake Detection Using Intra- and Cross-Modal Inconsistencies","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17088","snapshot_observed_at":"2026-08-07T10:18:40.105687Z","title":"URL https://doi.org/10.48550/arXiv.2311","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.105687Z"},"links":{"cited_paper":"/paper/2311.17088","citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:d8f04c39211eeb00e9020dfe3888eddbccc6b996c063460f3a353422794152dd","observation_id":"6cdee18e-af0b-4dca-be3f-381beda201c1","resolution":{"observed_at":"2026-08-07T10:18:40.105687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3625231","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:41.416784Z","title":"URLhttps://doi.org/10.1145/3625231","venue":null,"work_id":"d882521d-38d4-4c9c-87bf-0b94582d9540","year":null},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:35.280372Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:7a055d36b227abccb98f35845d6d6c88f8be1745a0b5c80633ff4280abd2e563","observation_id":"2c94da56-2dee-498f-beae-b0b40bdf9276","resolution":{"observed_at":"2026-08-07T10:18:41.519765Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:34.285971Z","title":"doi: 10.1109/CVPRW50498.2020.00338","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":2822,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:34.285971Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:94528718f14f248a48ad3719f604a7c8c999488fc75c03fbf3ec844d5149e5c5","observation_id":"43e8d5ad-f28d-41d9-b219-91e7264c234b","resolution":{"observed_at":"2026-08-07T10:18:34.285971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","latest_version":1,"primary_category":"cs.MM","snapshot_observed_at":"2026-08-07T10:11:01.569606Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":3,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":25,"verified_exact":5,"verified_fuzzy":19},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2506.05851."}