{"as_of":"2026-08-05T22:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e49f58492b40a18820171f408a6dfb7825e30d980aa7ffc01197c985d2f20ab0","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T22:17:25.548517Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T09:35:55.064011Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T09:44:37.945796Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"cited_work":{"arxiv_id":"2508.07337","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.07337","snapshot_observed_at":"2026-06-30T09:44:37.945796Z","title":"Klassify to verify: Audio-visual deepfake detection using ssl-based audio and handcrafted visual features.arXiv preprint arXiv:2508.07337,","venue":null,"work_id":"686e65f8-e936-4c0d-8b89-e4c453e0c96d","year":null},"citing_paper":{"arxiv_id":"2606.28933","last_updated":"2026-06-27T14:09:57Z","snapshot_observed_at":"2026-08-01T20:43:30.748435Z","submitted_at":"2026-06-27T14:09:57Z","title":"FinInvest-GTCN: Explainable Graph-Temporal-Causal Modeling for Risk-Aware Investment Decision Optimization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-30T09:35:55.064011Z"},"links":{"cited_paper":"/paper/2508.07337","citing_paper":"/paper/2606.28933"},"observation_digest":"sha256:6906a6491732dbaa3d04a0e06106589680befa0e43adc2caaa6eaf01fedc99e0","observation_id":"a2820e44-5b5d-4e16-bfd3-b66e1315f9b0","resolution":{"observed_at":"2026-06-30T09:44:37.947487Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.07337/citation-record","integrity":"/paper/2508.07337/integrity","json":"/paper/2508.07337/citation-record.json","paper":"/paper/2508.07337"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:27.198626Z","title":null,"venue":null,"work_id":"e3e7753b-aa91-48da-9c04-b70b9d2b4041","year":2020},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.365755Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:c7045e5981e62bfe033aa11e3395c90e9a7775ed09656326b4a14aaeea3f7037","observation_id":"3da54f0d-81a2-4250-bcf9-fcc0fab9ed5e","resolution":{"observed_at":"2026-08-05T22:17:27.202134Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:27.187964Z","title":null,"venue":null,"work_id":"97b1efaa-84dd-4cda-9be6-727a457831c1","year":2024},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.369864Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:2603ca0997efc244d86518916f5d14268307e1e9b022ae606eb3fcdc1fd3230a","observation_id":"230f8047-9a99-4280-88ed-4b562a861afd","resolution":{"observed_at":"2026-08-05T22:17:27.191547Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:26.993055Z","title":null,"venue":null,"work_id":"614ebb72-ed01-4a97-908f-d8b71be26605","year":2023},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.374083Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:e20a019d9af7adcf10235724ec1565b895ea5d70cd7e0edf8ad9e2c889f99269","observation_id":"86e3b0a0-5c3c-482f-b3ec-a30f8cacde42","resolution":{"observed_at":"2026-08-05T22:17:26.996823Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:27.177870Z","title":null,"venue":null,"work_id":"a3a94b71-96e2-4a1b-8c65-12bfe60adb59","year":2023},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.377908Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:d003dc0b9bc098b997bb817af45a77ec4e08701d8d3268f123434382c7a2573f","observation_id":"0ea2fdf1-52c4-461c-956c-c23c77796b8b","resolution":{"observed_at":"2026-08-05T22:17:27.181260Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-04T13:14:17.794450Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"cited_work":{"arxiv_id":"2507.20579","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.20579","snapshot_observed_at":"2026-08-05T22:17:26.813384Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","venue":"cs.CV","work_id":"c4a32274-03f2-4648-afae-42a5a7bd930d","year":2025},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.381762Z"},"links":{"cited_paper":"/paper/2507.20579","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:a5a201b416d64d56dcec2c9b1487915316dd3cdd8331c7351fb7e0d9d2483192","observation_id":"47a8baa8-4ad1-445f-9b59-851fc8f52547","resolution":{"observed_at":"2026-08-05T22:17:26.817489Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:27.168066Z","title":null,"venue":null,"work_id":"4ffa5dc5-867b-4090-b1bc-7cf166cb5707","year":2022},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.385976Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:620cba65e7ebf5d79b171530c68443f30ba382d31a8b7490defefb1df40b4690","observation_id":"54abbc1f-b1e6-43ce-adaf-01534d4fcaa5","resolution":{"observed_at":"2026-08-05T22:17:27.171485Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.02418","last_updated":"2023-04-30T17:46:06Z","snapshot_observed_at":"2026-07-06T12:15:24.403517Z","submitted_at":"2021-12-04T19:50:29Z","title":"YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.02418","snapshot_observed_at":"2026-08-05T22:17:25.389930Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.389930Z"},"links":{"cited_paper":"/paper/2112.02418","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:93353c70dc0304b61879a0fea7d70f8c47c10e8eb5e849c091f9bdc84bb36592","observation_id":"bf7e9da5-bd18-4b7b-bf20-d5cd1830ac11","resolution":{"observed_at":"2026-08-05T22:17:25.389930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04904","last_updated":"2024-06-07T12:56:11Z","snapshot_observed_at":"2026-07-06T18:27:07.473039Z","submitted_at":"2024-06-07T12:56:11Z","title":"XTTS: a Massively Multilingual Zero-Shot Text-to-Speech Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04904","snapshot_observed_at":"2026-08-05T22:17:25.394751Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.394751Z"},"links":{"cited_paper":"/paper/2406.04904","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:404a02e16bd02d7a7eb0e5ce1e60e8ca68ca037de16733aeb1099d0fe4e6256f","observation_id":"34c86899-5cac-4b9d-88c5-b7d52daf0ed0","resolution":{"observed_at":"2026-08-05T22:17:25.394751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:25.402835Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.402835Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:91ae4330ad1051c648d2a284812f6487785251d8908d57baca7c2f4799a6bc26","observation_id":"002ace39-8b08-476c-855c-73444e5fd8aa","resolution":{"observed_at":"2026-08-05T22:17:25.402835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:27.158084Z","title":null,"venue":null,"work_id":"84d1e6ca-5c20-4623-9e72-d4ab5e7365c1","year":2017},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.406419Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:752b9592389379ca2cd5f622856e621280d28f0eeb0559bd571fffa8c2be5a4e","observation_id":"bd6bab95-a672-47d5-90bc-00c702957f5d","resolution":{"observed_at":"2026-08-05T22:17:27.161479Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10113","last_updated":"2024-06-03T21:29:28Z","snapshot_observed_at":"2026-07-06T17:17:27.444056Z","submitted_at":"2024-01-18T16:35:37Z","title":"Exposing Lip-syncing Deepfakes from Mouth Inconsistencies","version":2},"cited_work":{"arxiv_id":"2401.10113","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.10113","snapshot_observed_at":"2026-08-05T22:17:26.567064Z","title":"Exposing Lip-syncing Deepfakes from Mouth Inconsistencies","venue":"cs.CV","work_id":"feb3c17f-1aea-4b2f-9e89-c86e021070c6","year":2024},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.409970Z"},"links":{"cited_paper":"/paper/2401.10113","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:491dd59adeb64bb48d1ba6f72ef03d91928a60ff94ff0efa449fe12ec263a0a5","observation_id":"3499f678-e809-4d85-8dcb-52fcf0866971","resolution":{"observed_at":"2026-08-05T22:17:26.571104Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01860","last_updated":"2021-10-11T05:15:08Z","snapshot_observed_at":"2026-07-06T11:44:19.030296Z","submitted_at":"2021-09-04T13:05:37Z","title":"Spatiotemporal Inconsistency Learning for DeepFake Video Detection","version":3},"cited_work":{"arxiv_id":"2109.01860","doi":null,"metadata_source":"pith","pith_arxiv_id":"2109.01860","snapshot_observed_at":"2026-08-05T22:17:26.551986Z","title":"Spatiotemporal Inconsistency Learning for DeepFake Video Detection","venue":"cs.CV","work_id":"efb77edd-04b9-4d75-a172-acaf0388d227","year":2021},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.413911Z"},"links":{"cited_paper":"/paper/2109.01860","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:69f30b5f4ded9d9e93d760b72f2a71dc126be6a6bf79e6f0a693ee66ce25c53a","observation_id":"aa6ba732-c2a1-4085-b07e-1e2700cb90d9","resolution":{"observed_at":"2026-08-05T22:17:26.556200Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:27.147009Z","title":null,"venue":null,"work_id":"17692e2b-63ae-4df5-af29-cdafb09adbdd","year":2021},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.418804Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:382b7837f687757a9f00895fda6bc4194c213463fc3294bd47144d5d0e3df0be","observation_id":"e86def50-3710-41b8-90fd-3002bd764eb9","resolution":{"observed_at":"2026-08-05T22:17:27.151096Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:27.135194Z","title":null,"venue":null,"work_id":"e4e65c2a-1b40-45d7-ae83-0cc103152f45","year":2022},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.422942Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:b8339da8fe46f476db684393a9992929e81f2787bad829575c0248b4a2a1d9fa","observation_id":"affd76cd-38e2-40b1-b95e-c1fa094f1bb9","resolution":{"observed_at":"2026-08-05T22:17:27.140090Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.06103","last_updated":"2021-06-11T01:07:12Z","snapshot_observed_at":"2026-08-02T17:41:21.677381Z","submitted_at":"2021-06-11T01:07:12Z","title":"Conditional Variational Autoencoder with Adversarial Learning for End-to-End Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.06103","snapshot_observed_at":"2026-08-05T22:17:25.427389Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.427389Z"},"links":{"cited_paper":"/paper/2106.06103","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:8b3c0f046e474c6c70c6420f48bdcdc360afd8e393643edbe55f4133e31d790f","observation_id":"862280ad-d7fe-4f7c-8889-4dc561fe5c4f","resolution":{"observed_at":"2026-08-05T22:17:25.427389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-05T22:17:25.431860Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.431860Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:6d3d7b85b373dab92052e6db9757aec33ef83bac6fb1b9f4295062ed43ffb83d","observation_id":"f27688b9-ce00-4830-85d9-78135954bdab","resolution":{"observed_at":"2026-08-05T22:17:25.431860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:27.124562Z","title":"Seltzer, and Sanjeev Khudanpur","venue":null,"work_id":"a8e6dcfd-3b85-48c2-802f-fdbfa797b532","year":2017},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.435728Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:bbba2b38005c6dfa9725be57dc4aede9c77ed6a1569d51d08e738cbec5ddc533","observation_id":"336b54d0-f4cd-4537-9079-4894c7d0aea2","resolution":{"observed_at":"2026-08-05T22:17:27.128773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:26.515322Z","title":null,"venue":null,"work_id":"8ffbb5a4-d92c-48ba-a040-02dcede66500","year":2024},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.439554Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:db998a6facc140c08bc4f914fa2110860a8a55a1e88bc24754e47ab15b2d3411","observation_id":"4501f9fd-2112-4c3e-8905-3de961d9b38a","resolution":{"observed_at":"2026-08-05T22:17:26.519066Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05576","last_updated":"2019-04-11T08:37:43Z","snapshot_observed_at":"2026-08-04T01:08:27.264191Z","submitted_at":"2019-04-11T08:37:43Z","title":"STC Antispoofing Systems for the ASVspoof2019 Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.05576","snapshot_observed_at":"2026-08-05T22:17:25.443681Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.443681Z"},"links":{"cited_paper":"/paper/1904.05576","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:bdf1247515aa0c313f357c3883117e26e2da701a931fc9dfd86afd0c9a7e65b0","observation_id":"044068f9-fb6e-425f-8def-40a234dc76fe","resolution":{"observed_at":"2026-08-05T22:17:25.443681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.08242","last_updated":"2016-08-29T20:48:15Z","snapshot_observed_at":"2026-07-06T05:08:32.810423Z","submitted_at":"2016-08-29T20:48:15Z","title":"Temporal Convolutional Networks: A Unified Approach to Action Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.08242","snapshot_observed_at":"2026-08-05T22:17:25.447426Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.447426Z"},"links":{"cited_paper":"/paper/1608.08242","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:810e20fe0f8d1036846b8957b7c36889ae358e5c7ddcc26ea6f3fceebbc343fe","observation_id":"f3742b88-992a-4be0-9d35-03ed77ecece1","resolution":{"observed_at":"2026-08-05T22:17:25.447426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09262","last_updated":"2025-03-13T09:17:52Z","snapshot_observed_at":"2026-07-06T20:05:55.982214Z","submitted_at":"2024-12-12T13:20:52Z","title":"LatentSync: Taming Audio-Conditioned Latent Diffusion Models for Lip Sync with SyncNet Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09262","snapshot_observed_at":"2026-08-05T22:17:25.451010Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.451010Z"},"links":{"cited_paper":"/paper/2412.09262","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:f0ae474803d4feaee9cdfd6037d4ddaf939298a36c8f716aa09ea2723e9d6c08","observation_id":"cc0a9d86-07da-450b-8e5f-dadf9baa51c7","resolution":{"observed_at":"2026-08-05T22:17:25.451010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:27.114172Z","title":null,"venue":null,"work_id":"35698d33-363a-41e2-a9e0-d5b18d458d89","year":null},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.454614Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:66a99b292e8480158bd8e20a02aa9fddb6cdc99a5b9acc4ceb07279db6b74c64","observation_id":"1da8e7dd-5abe-4836-a553-1d01aa5ad10a","resolution":{"observed_at":"2026-08-05T22:17:27.117758Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T22:17:25.461531Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.461531Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:eeedcd759cba69c1cd7d86b062e06b3c021ff6755fbafd80e22110e80a9cccf6","observation_id":"d7f939b8-5384-4993-a5dd-c7e32b56c250","resolution":{"observed_at":"2026-08-05T22:17:25.461531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.03983","last_updated":"2017-05-03T16:28:09Z","snapshot_observed_at":"2026-07-06T05:06:55.589962Z","submitted_at":"2016-08-13T13:46:05Z","title":"SGDR: Stochastic Gradient Descent with Warm Restarts","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.03983","snapshot_observed_at":"2026-08-05T22:17:25.465630Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.465630Z"},"links":{"cited_paper":"/paper/1608.03983","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:32c0418d72c2cb053db7d975eaafeb753fa26abf21346a5451b8b81115439cfe","observation_id":"1cfd59c4-05a0-4336-8002-07fa2c59feef","resolution":{"observed_at":"2026-08-05T22:17:25.465630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08172","last_updated":"2019-06-14T05:49:22Z","snapshot_observed_at":"2026-08-05T19:15:35.517082Z","submitted_at":"2019-06-14T05:49:22Z","title":"MediaPipe: A Framework for Building Perception Pipelines","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08172","snapshot_observed_at":"2026-08-05T22:17:25.469423Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.469423Z"},"links":{"cited_paper":"/paper/1906.08172","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:ad8bac465913f300f57a043af35e1e03721b2b6eb749f2371947731698bba90f","observation_id":"da341f57-c6bd-4d5c-a1bf-2959cd7e4231","resolution":{"observed_at":"2026-08-05T22:17:25.469423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09716","last_updated":"2023-08-18T17:59:40Z","snapshot_observed_at":"2026-08-04T14:37:32.149732Z","submitted_at":"2023-08-18T17:59:40Z","title":"Diff2Lip: Audio Conditioned Diffusion Models for Lip-Synchronization","version":1},"cited_work":{"arxiv_id":"2308.09716","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.09716","snapshot_observed_at":"2026-08-05T22:17:26.079138Z","title":"Diff2Lip: Audio Conditioned Diffusion Models for Lip-Synchronization","venue":"cs.CV","work_id":"e988d36f-7966-41eb-a27d-4f48a2cc4016","year":2023},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.473165Z"},"links":{"cited_paper":"/paper/2308.09716","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:a5bbcb4385cb92e5d68c1f5e739add6a701446dda099dd98ef27bff843875f8b","observation_id":"5981fcef-485b-4419-bd10-2d1518cf3f19","resolution":{"observed_at":"2026-08-05T22:17:26.085195Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:25.476790Z","title":"Müller, Pavel Czempin, Franziska Dieckmann, Adam Froghyar, and Konstantin Böttinger","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.476790Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:2266fe044916ddd4e67fdf177b045674310be82798bd393784eba281b4e6cecb","observation_id":"a24eb2d2-9c75-4bf4-9a0b-de1b63d4edac","resolution":{"observed_at":"2026-08-05T22:17:25.476790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:27.102127Z","title":null,"venue":null,"work_id":"98c1e392-0db9-4ba0-8e2d-8f41e22c7d8b","year":null},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.480090Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:f0f73f41e2a5f3c012fc855db13b8a443a7a8f1c3abf942d0c1a4cddded801c8","observation_id":"a504b6b5-a700-4dbc-988b-1ccafa36230a","resolution":{"observed_at":"2026-08-05T22:17:27.105874Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:27.090670Z","title":null,"venue":null,"work_id":"7e6183dc-e859-445d-9d64-8e3fdf57392f","year":2009},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.483599Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:c59a49c75bb4dc01b6878722491f4682aec9061056f6a107a705d0be6379d617","observation_id":"8721028f-9752-4c58-acdf-ef1129ff95e6","resolution":{"observed_at":"2026-08-05T22:17:27.094750Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:27.080065Z","title":null,"venue":null,"work_id":"d6f493f6-b646-4930-a47a-d189f37c06d9","year":2022},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.487045Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:d4cbb02e7dd5d20e79f08e558ddcc0ab42ac312251ee99ba02948ed31540714e","observation_id":"bd101732-072c-4c3e-888a-6f41f23f7e5e","resolution":{"observed_at":"2026-08-05T22:17:27.083498Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v37i4.25658","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:25.611241Z","title":null,"venue":null,"work_id":"52bd982b-9bed-42bb-8a66-1b0d3c6d2d7b","year":2023},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.490605Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:07083fe8bd3cdaa340e085d5f610e79c81fba2cf9d7319650dfc3c3236e70637","observation_id":"836739d9-33fe-4cdd-940e-4ea158211235","resolution":{"observed_at":"2026-08-05T22:17:25.615500Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:27.069073Z","title":null,"venue":null,"work_id":"e8024b18-6a4c-4580-916b-f6a98acdcab4","year":2019},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.493917Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:2ba64b686f18a63085d6e3bed46e88a8583dbea1fe3ec0dc2b7c38c04dc1f466","observation_id":"ab6f6ea2-1af5-4bd6-8b93-e2c9c0a34696","resolution":{"observed_at":"2026-08-05T22:17:27.072786Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:27.058319Z","title":"Tan, and Haizhou Li","venue":null,"work_id":"795f6306-1510-42b9-b3fd-d3b636bd6f77","year":null},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.497426Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:8284e124fcfc25fc43ac21ec5fa7e4e06b9c5960b37ff59c40976c1daa49ae40","observation_id":"db4de0b6-641b-4a24-8ce2-f2814d075a3c","resolution":{"observed_at":"2026-08-05T22:17:27.062146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08739","last_updated":"2024-08-16T13:37:20Z","snapshot_observed_at":"2026-07-06T19:01:32.237848Z","submitted_at":"2024-08-16T13:37:20Z","title":"ASVspoof 5: Crowdsourced Speech Data, Deepfakes, and Adversarial Attacks at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08739","snapshot_observed_at":"2026-08-05T22:17:25.504802Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.504802Z"},"links":{"cited_paper":"/paper/2408.08739","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:20bab5ed17181ac2ec43aaab6f6be57c514de7b94fd75e5985b6882039b3400e","observation_id":"9c22736f-be89-49a9-ab79-a673de37db9a","resolution":{"observed_at":"2026-08-05T22:17:25.504802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.10550","last_updated":"2018-07-27T12:31:16Z","snapshot_observed_at":"2026-08-04T23:31:03.238535Z","submitted_at":"2018-07-27T12:31:16Z","title":"X2Face: A network for controlling face generation by using images, audio, and pose codes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.10550","snapshot_observed_at":"2026-08-05T22:17:25.508468Z","title":"Sophia Koepke, and Andrew Zisserman","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.508468Z"},"links":{"cited_paper":"/paper/1807.10550","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:193339ea022292dacd200b749341b92a2fc208adb3ae56bea47c5a377e8bdc68","observation_id":"4107b677-3ad0-4d97-8225-9943688319b6","resolution":{"observed_at":"2026-08-05T22:17:25.508468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.24866","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:25.848928Z","title":null,"venue":null,"work_id":"fc4054b0-5a81-461b-b520-cf3a67fb03c9","year":2025},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.512036Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:5a9f826db329f18c16fa3122c0579691b677203cbfb791e6d70465138562b91c","observation_id":"4eff63d3-3ed7-41e5-922c-895771e5b883","resolution":{"observed_at":"2026-08-05T22:17:25.855366Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:27.047131Z","title":null,"venue":null,"work_id":"e4b5e4ea-4bfa-41b1-bfcf-5943e1f43a8b","year":2021},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.515827Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:096f7636b5a1ce6b6f99ea1ad8d4709c89558d1ec409aa75e591e416156bf784","observation_id":"bb2f5501-2b10-4c10-9aee-83747ea7cd9c","resolution":{"observed_at":"2026-08-05T22:17:27.050997Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:25.519197Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.519197Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:6d1634ffa314f86bf140c4dbb002d6db3150da956f46320de40872e381317bcc","observation_id":"f85b5164-d2e9-48d2-87a8-667ce17e12da","resolution":{"observed_at":"2026-08-05T22:17:25.519197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/asvspoof.2021-2","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:25.587516Z","title":null,"venue":null,"work_id":"3cd3793e-8142-4939-aa7d-885feb973aba","year":2021},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.526995Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:3adade0b1e0f1aff240f2226f1cb4449e26e638f2e579f6ef9dfadc28824fb27","observation_id":"98ecb5ef-b906-434c-b8d3-3e918b73d9dc","resolution":{"observed_at":"2026-08-05T22:17:25.591214Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2021-738","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:25.574679Z","title":null,"venue":null,"work_id":"816334f1-13c4-4a96-9533-f7048b2c7629","year":2021},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.530547Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:c4295b7a51eade0efe44607cb9ed8d389f4498ee22f20cd1736ee278b168b6d0","observation_id":"a98db008-d9f6-4c78-82d9-26e0e75a6df1","resolution":{"observed_at":"2026-08-05T22:17:25.579641Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/taslp.20","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:25.598760Z","title":"doi:10.1109/TASLP.20 22.3233236","venue":null,"work_id":"9723d2a0-909c-4388-bb83-01ed0ff9e8e0","year":null},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.522790Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:529d9530a6a42d10d5e2a067fd956680dee0f9204856d6feb1aa1daf7012fd21","observation_id":"2631bc11-e294-4147-86f7-a131d32a31d9","resolution":{"observed_at":"2026-08-05T22:17:25.602978Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:27.016365Z","title":null,"venue":null,"work_id":"de4e2411-75e8-47e1-9ca9-e7c5573861f9","year":2025},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.537366Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:23dbe6a6bea621986a22b464efb46d0e0f132de78c43dc6f7587f85b8e63c975","observation_id":"0cc0d056-d47a-48a7-9977-ebf77ae24a0c","resolution":{"observed_at":"2026-08-05T22:17:27.020691Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.06693","last_updated":"2021-08-15T08:45:37Z","snapshot_observed_at":"2026-08-04T10:02:24.723533Z","submitted_at":"2021-08-15T08:45:37Z","title":"Exploring Temporal Coherence for More General Video Face Forgery Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.06693","snapshot_observed_at":"2026-08-05T22:17:25.540877Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.540877Z"},"links":{"cited_paper":"/paper/2108.06693","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:d1430802bbcf3745e5d1441ae544e96431d58b693584f5d6401b459387092e05","observation_id":"0cb2f746-2181-4690-9862-3b4db61de352","resolution":{"observed_at":"2026-08-05T22:17:25.540877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:27.029039Z","title":null,"venue":null,"work_id":"af498d69-0a15-412c-99a4-bc138ebabb44","year":2023},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.534133Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:c4e79d95bb44190eec4f85b8c8177bf84ebcb036d8eeb1b2e9802a48d2d55c41","observation_id":"674657c0-e699-480b-ba66-9e2fc3711253","resolution":{"observed_at":"2026-08-05T22:17:27.032993Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:27.005431Z","title":null,"venue":null,"work_id":"23875a28-1363-41e5-be18-8a454759154f","year":2005},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.548517Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:5afde7e8c9ac37f1925e291fc396815870dc755e63653a3cb93323e38ce3795a","observation_id":"31c55a26-c54b-4616-86bb-fcb4cdf17a14","resolution":{"observed_at":"2026-08-05T22:17:27.009094Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21611","last_updated":"2024-08-19T16:09:14Z","snapshot_observed_at":"2026-07-06T18:55:02.790902Z","submitted_at":"2024-07-31T13:49:17Z","title":"Enhancing Partially Spoofed Audio Localization with Boundary-aware Attention Mechanism","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21611","snapshot_observed_at":"2026-08-05T22:17:25.544884Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.544884Z"},"links":{"cited_paper":"/paper/2407.21611","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:277c3dfe82addae966af1db008ee68d2e0ed1ea626d0fa4349ede9a67f5a5610","observation_id":"7c7c11e8-48d3-48aa-941e-64d1b0ff9da9","resolution":{"observed_at":"2026-08-05T22:17:25.544884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17480","last_updated":"2023-03-29T07:51:07Z","snapshot_observed_at":"2026-07-06T15:10:08.462773Z","submitted_at":"2023-03-29T07:51:07Z","title":"Seeing What You Said: Talking Face Generation Guided by a Lip Reading Expert","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17480","snapshot_observed_at":"2026-08-05T22:17:25.501007Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.501007Z"},"links":{"cited_paper":"/paper/2303.17480","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:08974634318a166f66319efa7b25fadf83f2b2a3a43978814a64a7f20306ea8c","observation_id":"34666ccd-e60c-438e-8414-6959a9304859","resolution":{"observed_at":"2026-08-05T22:17:25.501007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"int/7945646","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:17:26.281374Z","title":null,"venue":null,"work_id":"8b8d7e46-9f6c-4b07-aea5-07366978ec97","year":2025},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.458199Z"},"links":{"citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:5a44ea84a9da90125f80acde33827bd1fc4acf1c56cb07fec1e71825fc5d4a40","observation_id":"b4eda6cf-1042-46a9-a7e9-866cefd85dc4","resolution":{"observed_at":"2026-08-05T22:17:26.288857Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-05T22:17:24.737081Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":12,"verified_fuzzy":2},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 1 inbound Pith citation observation for arXiv:2508.07337."}