{"as_of":"2026-08-19T16:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dd576d28b1062273b766cbc7abf51b2bc2baa0052f181755138c66d228aa6e49","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T15:10:16.214727Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.26472/citation-record","integrity":"/paper/2607.26472/integrity","json":"/paper/2607.26472/citation-record.json","paper":"/paper/2607.26472"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.08739","last_updated":"2024-08-16T13:37:20Z","snapshot_observed_at":"2026-08-19T02:11:16.717807Z","submitted_at":"2024-08-16T13:37:20Z","title":"ASVspoof 5: Crowdsourced Speech Data, Deepfakes, and Adversarial Attacks at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08739","snapshot_observed_at":"2026-08-01T15:10:12.454574Z","title":"arXiv preprint arXiv:2408.08739 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:12.454574Z"},"links":{"cited_paper":"/paper/2408.08739","citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:574a7a0de936abe1154457f5e079aec795b0639f28542f697cedfa4616a86a34","observation_id":"74f90f8d-e19a-4b67-8dc4-e35f122c4be5","resolution":{"observed_at":"2026-08-01T15:10:12.454574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03944","last_updated":"2026-04-11T14:44:45Z","snapshot_observed_at":"2026-08-16T15:37:45.316156Z","submitted_at":"2026-01-07T14:01:10Z","title":"ASVspoof 5: Evaluation of Spoofing, Deepfake, and Adversarial Attack Detection Using Crowdsourced Speech","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03944","snapshot_observed_at":"2026-08-01T15:10:12.497831Z","title":"arXiv preprint arXiv:2601.03944 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:12.497831Z"},"links":{"cited_paper":"/paper/2601.03944","citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:5a79c052bef6bcc479b563e6677411088a796027dac310181b1f7cc1e85ff2ca","observation_id":"ef8f2ee3-b342-417f-8595-c0fd20c42eed","resolution":{"observed_at":"2026-08-01T15:10:12.497831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:12.589869Z","title":"Proceedings of ICASSP , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:12.589869Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:ee975b5651c2d6f4096c3225e659dcf9c4f53be2c43e019dab8b8ec22906384f","observation_id":"f40bc0a8-c1fe-4497-aa7b-1639221c69ad","resolution":{"observed_at":"2026-08-01T15:10:12.589869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:12.690983Z","title":"Proceedings of ICASSP , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:12.690983Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:6cae25e5984278db85e493175f8ca4ab29b32dd4b3acf903e18a6706b9b3d088","observation_id":"b1805291-0e63-46e6-9cb0-18521f3547bd","resolution":{"observed_at":"2026-08-01T15:10:12.690983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:12.789411Z","title":"IEEE Journal of Selected Topics in Signal Processing , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:12.789411Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:96e2187d1fe61b8998a79df5f33c29057ea7bf85041a19e0343dcb5aaa42430a","observation_id":"a391f650-17c4-4035-87e4-ee38dd251f47","resolution":{"observed_at":"2026-08-01T15:10:12.789411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:12.905990Z","title":"IEEE/ACM Transactions on Audio, Speech, and Language Processing , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:12.905990Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:b0ab12e18c86a2ef00086f2d2b0e5c60c116312eab3f929db208aaaf784c22dc","observation_id":"81c5f6d0-2e78-4002-9e07-12231dcc0975","resolution":{"observed_at":"2026-08-01T15:10:12.905990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:12.984215Z","title":"Does Audio Deepfake Detection Generalize? , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:12.984215Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:4534d99d410b51e4b961e3d8811a545261ca7563e0b3fd12b4089608a8fa55e4","observation_id":"2fb77621-4e19-49b7-9702-be96d3f0f9c5","resolution":{"observed_at":"2026-08-01T15:10:12.984215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:13.060941Z","title":"IEEE/ACM Transactions on Audio, Speech, and Language Processing , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:13.060941Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:df217ddb245a130d4b265a163b7cc2779bb9732037efaa7f05ac942e62b974ce","observation_id":"69f16c31-3c60-462a-bcd5-307813a01732","resolution":{"observed_at":"2026-08-01T15:10:13.060941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:13.137495Z","title":"Proceedings of Interspeech , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:13.137495Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:a5300ec31aab989324c9c7addedfd76c9575ad03f36cff35be157eaf3b88fb43","observation_id":"e656d7be-1d7d-4cd0-916b-8e770fc56cfd","resolution":{"observed_at":"2026-08-01T15:10:13.137495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:13.214449Z","title":"Proceedings of ACL , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:13.214449Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:40a85f25c5f9ed1688d4aa5b7c3adc259c89a75753c554a4df2f3d67e366bd5d","observation_id":"f25656e6-a335-4ee4-82b4-7ead992f6a20","resolution":{"observed_at":"2026-08-01T15:10:13.214449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:13.290698Z","title":"Advances in Neural Information Processing Systems , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:13.290698Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:ac5462a446c43a071a730bf452790211a1c1d4c4ba4fc83316cf73d5f1b94001","observation_id":"dc7a257f-09b7-4ac9-bed3-b5d723c7f1e0","resolution":{"observed_at":"2026-08-01T15:10:13.290698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:13.399401Z","title":"Proceedings of CVPR , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:13.399401Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:5cdaf1125eac60c4e1e09f8340fbcc38b0ecd6bd71152296b29b2093441abbad","observation_id":"af488629-9561-419c-becc-1d4c5bd39724","resolution":{"observed_at":"2026-08-01T15:10:13.399401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:13.471798Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:13.471798Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:2110561e6e5d026e25b4012727685b9eb83cc0d5260e654decd2bb9791af3d7b","observation_id":"82914684-df6d-4580-9f61-b417d708553b","resolution":{"observed_at":"2026-08-01T15:10:13.471798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11909","last_updated":"2024-09-18T12:10:04Z","snapshot_observed_at":"2026-08-16T13:17:31.664649Z","submitted_at":"2024-09-18T12:10:04Z","title":"Mixture of Experts Fusion for Fake Audio Detection Using Frozen wav2vec 2.0","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11909","snapshot_observed_at":"2026-08-01T15:10:13.568877Z","title":"arXiv preprint arXiv:2409.11909 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:13.568877Z"},"links":{"cited_paper":"/paper/2409.11909","citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:d42a8f60f6fc70dc42148a83ffca86fdfb48613983fafa44e9ac28197168bae5","observation_id":"467b842c-d980-47d2-9785-adc6f9c385c8","resolution":{"observed_at":"2026-08-01T15:10:13.568877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:13.702573Z","title":"IEEE Signal Processing Letters , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:13.702573Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:d08c9a8f3b2333fd6865805899a599f2feb18ae347f0adbf00d2fd5e8e314d3b","observation_id":"1f0c2c8d-3249-4063-95cc-c344fe044f16","resolution":{"observed_at":"2026-08-01T15:10:13.702573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:13.841396Z","title":"Proceedings of Interspeech , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:13.841396Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:6147ff02f7912f3f5e0770c66524a5498759aafc3fe8b9985564bf778d2a49cd","observation_id":"43df4566-e8cc-4f30-804e-2ff6419d6f03","resolution":{"observed_at":"2026-08-01T15:10:13.841396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:13.934557Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:13.934557Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:446d7f3a8dbf2f68e34d5f809d7b1c106bd5f91e024ec50f1a13aaf5f07ad17c","observation_id":"ce33b8cc-802a-425b-adcb-aab8dcc6214e","resolution":{"observed_at":"2026-08-01T15:10:13.934557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05441","last_updated":"2019-04-14T11:38:32Z","snapshot_observed_at":"2026-08-15T22:10:10.299222Z","submitted_at":"2019-04-09T15:12:52Z","title":"ASVspoof 2019: Future Horizons in Spoofed and Fake Audio Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.05441","snapshot_observed_at":"2026-08-01T15:10:14.045228Z","title":"arXiv preprint arXiv:1904.05441 , year =","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:14.045228Z"},"links":{"cited_paper":"/paper/1904.05441","citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:f0d5e866dcba6c7d54724d272186e02b95ccfab31bd20e72c2383122180ed504","observation_id":"abb5e356-ee89-4933-a6b6-f204860a0cd5","resolution":{"observed_at":"2026-08-01T15:10:14.045228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06670","last_updated":"2020-03-05T20:37:08Z","snapshot_observed_at":"2026-08-12T13:38:15.911519Z","submitted_at":"2019-12-13T19:22:44Z","title":"Common Voice: A Massively-Multilingual Speech Corpus","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06670","snapshot_observed_at":"2026-08-01T15:10:14.178271Z","title":"arXiv preprint arXiv:1912.06670 , year =","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:14.178271Z"},"links":{"cited_paper":"/paper/1912.06670","citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:6eee532f68444d32144bb3ded9798f28bb313d95ca3b3c8bbb52acac8955e17a","observation_id":"0e9e35a7-7d5f-4727-a126-579c37965c3c","resolution":{"observed_at":"2026-08-01T15:10:14.178271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:14.303673Z","title":"Proceedings of ICASSP , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:14.303673Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:8f0740c61e5118a2613fe9680184773e97abe9e432cd021534afa6914247bd8e","observation_id":"e970e32c-ce84-4529-bf03-5d7f18d3615d","resolution":{"observed_at":"2026-08-01T15:10:14.303673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:14.386489Z","title":"Proceedings of Interspeech , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:14.386489Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:77b167915187cffa9665301ea09e437d717674852a910ed75ee39e634e979abf","observation_id":"2ee9cf49-4631-42a9-b04d-07f9ccf7f5d8","resolution":{"observed_at":"2026-08-01T15:10:14.386489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:14.462158Z","title":"Proceedings of ICML , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:14.462158Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:186a48f655c90060c6cf7822daf5f8ca164d4d66a562ccc2cdcecaa5755c0b43","observation_id":"f4a3e772-aaa9-4838-b9ef-24cdf93d5c16","resolution":{"observed_at":"2026-08-01T15:10:14.462158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.09761","last_updated":"2021-03-30T19:48:38Z","snapshot_observed_at":"2026-07-06T09:57:19.117228Z","submitted_at":"2020-09-21T11:20:38Z","title":"DiffWave: A Versatile Diffusion Model for Audio Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.09761","snapshot_observed_at":"2026-08-01T15:10:14.595106Z","title":"arXiv preprint arXiv:2009.09761 , year =","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:14.595106Z"},"links":{"cited_paper":"/paper/2009.09761","citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:8e09d64f0fa63a6bf42b712fc038b33886bb56c0243b29723e836864fbca7419","observation_id":"5f10bcd2-b951-49bf-b920-79bc653b2cf2","resolution":{"observed_at":"2026-08-01T15:10:14.595106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:14.680280Z","title":"Proceedings of ICML , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:14.680280Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:a2dab40c523c937aebe88cb11fde93338f3ed756fc6e1dcb62f26ed823857e63","observation_id":"dcaf325d-706d-4819-a902-23235f7660cc","resolution":{"observed_at":"2026-08-01T15:10:14.680280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:14.833616Z","title":"Proceedings of ICASSP , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:14.833616Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:b80ce5eb39669cf2b8c6034642ae130717a17c5c71b4d4905df1b18e9291700d","observation_id":"37977775-6f02-4151-bac8-ff30f38cbb1b","resolution":{"observed_at":"2026-08-01T15:10:14.833616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:14.947270Z","title":"Proceedings of the ASVspoof Workshop , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:14.947270Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:f9ccefe0d812639b4aee7443f0fdf1657844ba057b16155112d56743b6f2c6db","observation_id":"e51a1e3a-bcd5-4178-8f04-8b25010eb3ac","resolution":{"observed_at":"2026-08-01T15:10:14.947270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:15.042338Z","title":"Proceedings of ACM Multimedia , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:15.042338Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:c0474bc5f5242363b38be93a52b668fb57f683b19fed5946d5b546c57dbd02a9","observation_id":"168d41b4-86a3-4ac8-b4ea-12fc3d588a43","resolution":{"observed_at":"2026-08-01T15:10:15.042338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:15.109040Z","title":"IEEE Open Journal of Signal Processing , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:15.109040Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:7494a98ada9c728a988096a9410c0321032eabb6885ff1672c82e83a95c96dc1","observation_id":"832117fd-d49d-4a65-bb48-43717a39a113","resolution":{"observed_at":"2026-08-01T15:10:15.109040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:15.226410Z","title":"Leveraging Frequency Analysis for Deep Fake Image Recognition , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:15.226410Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:5e2f614ced07d3d99708c48894520f245032fd477a970642d2df88e599af9c2f","observation_id":"ce5399c0-f0fd-42e6-9126-4c115e14b130","resolution":{"observed_at":"2026-08-01T15:10:15.226410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:15.314510Z","title":"Advances in Neural Information Processing Systems , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:15.314510Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:51645328346f7bf910f0e353ee18b4acc40be297dd18377b913eeb7281103d78","observation_id":"65ae713c-7cdc-4e95-9d82-72954f87518e","resolution":{"observed_at":"2026-08-01T15:10:15.314510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:15.430511Z","title":"Proceedings of EMNLP , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:15.430511Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:1db189f9abceb3265b7c3945ede3190afcd4c300d21cfb0d3f9154e70109d3cb","observation_id":"1651996b-a948-4554-a79a-f861a6da7360","resolution":{"observed_at":"2026-08-01T15:10:15.430511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:15.544798Z","title":"Proceedings of the ASVspoof Workshop , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:15.544798Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:b053a733c00e88a256448c20d9a28830e08fb01869e523b58a31bf6be950e593","observation_id":"f22d945f-4edf-4062-987e-312236724ec3","resolution":{"observed_at":"2026-08-01T15:10:15.544798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:15.663003Z","title":"Robust Audio Deepfake Detection: Exploring Front-/Back-End Combinations and Data Augmentation Strategies for the","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:15.663003Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:f4c326a1078d7b1d5e70cf329352efb92e0db7e710cfc97be9ee4fcce3b56e4e","observation_id":"87036b26-d516-422a-87d0-5b72669283e2","resolution":{"observed_at":"2026-08-01T15:10:15.663003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:15.749471Z","title":"Applied Sciences , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:15.749471Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:531c68a8b124833e44965593a6d6282f7515a4f7c0c61146b1af9946cbd9dffb","observation_id":"a0881aa6-c2b2-4d1e-be6b-bf70f0bc9718","resolution":{"observed_at":"2026-08-01T15:10:15.749471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:15.915300Z","title":"IEEE/ACM Transactions on Audio, Speech, and Language Processing , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:15.915300Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:384942a94261a37a5cf7acc1e1f6576ee3737e22d8251d7ccc8288083dde4552","observation_id":"0134e27b-2a2c-4909-8d03-d20323514544","resolution":{"observed_at":"2026-08-01T15:10:15.915300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.26465","last_updated":"2026-04-29T09:21:26Z","snapshot_observed_at":"2026-08-18T07:33:09.238506Z","submitted_at":"2026-04-29T09:21:26Z","title":"Diffusion Reconstruction towards Generalizable Audio Deepfake Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.26465","snapshot_observed_at":"2026-08-01T15:10:16.075818Z","title":"arXiv preprint arXiv:2604.26465 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:16.075818Z"},"links":{"cited_paper":"/paper/2604.26465","citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:3414c7262b8b3d5bc55e9eb1ab2f1ea51a9bbee6f7a5b11d30db597927471cf5","observation_id":"061f2c7e-d532-4373-8ad8-57f551bf3cca","resolution":{"observed_at":"2026-08-01T15:10:16.075818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:10:16.214727Z","title":"Proceedings of Interspeech , pages =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-01T15:10:16.214727Z"},"links":{"citing_paper":"/paper/2607.26472"},"observation_digest":"sha256:b56dc8732f679675b2489e0726947d216db94774b6f627f3b72481c6af72868d","observation_id":"596190ce-f569-47bc-a7d7-4660341d4ee6","resolution":{"observed_at":"2026-08-01T15:10:16.214727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.26472","last_updated":"2026-07-29T04:55:14Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T17:49:05.797860Z","submitted_at":"2026-07-29T04:55:14Z","title":"Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2607.26472."}