{"as_of":"2026-08-08T09:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e6dd2386b6c1a20898f3cb96879a135161d006a6c4ff796942c4b458e73ddd54","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T13:38:07.664244Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.20417/citation-record","integrity":"/paper/2507.20417/integrity","json":"/paper/2507.20417/citation-record.json","paper":"/paper/2507.20417"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:09.381792Z","title":"A comprehensive survey with critical analysis for deepfake speech detection,","venue":null,"work_id":"206746be-3a84-4b98-a03b-76e9af19e586","year":2025},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:04.162625Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:abaa7e539cfafeae315f795270d04cc1e15dfb6da8946b7bb96dac0163353690","observation_id":"086d15b3-1154-4b59-aa0b-80d8636f5d06","resolution":{"observed_at":"2026-08-06T13:38:09.388169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:09.358525Z","title":"Boosting large language model for speech synthesis: An empirical study,","venue":null,"work_id":"a37b0866-3042-4586-8f26-3120026ca54d","year":2025},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:04.336331Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:3fd69890a66f606bb3b49c52db03825d93f5ed005335a40b73d018856528bb8a","observation_id":"b84135f2-34e8-4c2b-be45-8a5213fa4881","resolution":{"observed_at":"2026-08-06T13:38:09.364829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11000","last_updated":"2023-05-19T14:41:16Z","snapshot_observed_at":"2026-08-07T10:56:05.622094Z","submitted_at":"2023-05-18T14:23:25Z","title":"SpeechGPT: Empowering Large Language Models with Intrinsic Cross-Modal Conversational Abilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11000","snapshot_observed_at":"2026-08-06T13:38:04.555891Z","title":"Speechgpt: Empowering large language models with intrinsic cross-modal conversational abilities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:04.555891Z"},"links":{"cited_paper":"/paper/2305.11000","citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:234a8bf68fcaf1af6722a3410e86b64dc0912399a754b20a87fc28c650bc52de","observation_id":"e4b63a73-ba88-4391-a3b5-951028839354","resolution":{"observed_at":"2026-08-06T13:38:04.555891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12925","last_updated":"2023-06-22T14:37:54Z","snapshot_observed_at":"2026-08-07T01:18:02.068918Z","submitted_at":"2023-06-22T14:37:54Z","title":"AudioPaLM: A Large Language Model That Can Speak and Listen","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12925","snapshot_observed_at":"2026-08-06T13:38:04.799140Z","title":"Audiopalm: A large language model that can speak and listen,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:04.799140Z"},"links":{"cited_paper":"/paper/2306.12925","citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:611020c9c6832d5fe4d5ea3fcee102c67f9fd900efc0c31ff54fa1c44270880e","observation_id":"1acd1621-7dc7-4551-98bd-a3d9d860c72e","resolution":{"observed_at":"2026-08-06T13:38:04.799140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:09.333404Z","title":"Deepfake audio is a political nightmare,","venue":null,"work_id":"ef19c6a8-8726-42d0-89ce-654744441fab","year":2023},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:04.965937Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:d532a4b700ccc42a6b1f1d003e1b0b8581db032da07158447c9966af9409856b","observation_id":"e921b016-431a-4a22-8558-0af3db1f7e0c","resolution":{"observed_at":"2026-08-06T13:38:09.344402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:09.292916Z","title":"Beware the artificial impostor: A mcafee cybersecurity artificial intelligence report 2023,","venue":null,"work_id":"8779c5e7-a815-44f6-8875-83bd1f2e44b7","year":2023},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:05.166224Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:79d7e1814e9b0434511cf5e05533a8f9c0c79df3beeb18e6b018a74c6072ea6c","observation_id":"b92b82be-2eeb-4a1b-92cf-99bd952756ca","resolution":{"observed_at":"2026-08-06T13:38:09.299568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:05.404400Z","title":"Ur channel-robust syn- thetic speech detection system for asvspoof 2021,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:05.404400Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:fd1f8877d74ab1b3b366ea192be0ad7ea8e3bf67e4a63eaab468d7c50cf3a797","observation_id":"e62ea8cf-2016-4ad7-b6ec-7a64bb39b1b2","resolution":{"observed_at":"2026-08-06T13:38:05.404400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:09.255784Z","title":"The biometric vox system for the asvspoof 2021 challenge,","venue":null,"work_id":"14b0b6dd-4d36-4c92-a3a0-ea3de36989fb","year":2021},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:05.632666Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:86c26a013c647cb5afa89666462cc8285677d61c0305f55b06279b8d9bb6c1dc","observation_id":"c614b1e8-da7a-4edb-80d3-fc43ef6a999a","resolution":{"observed_at":"2026-08-06T13:38:09.273554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:09.212352Z","title":"Known-unknown data augmentation strategies for detection of logical access, physical access and speech deepfake attacks: Asvspoof 2021,","venue":null,"work_id":"cadcd007-fab1-4c26-b755-586231cdb2f0","year":2021},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:05.865803Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:223db45c4229327fee11d73d752cacbdfea5b18935c03f79a31f4aabd39b376e","observation_id":"0e69152b-a136-4772-bb91-b209f3600da5","resolution":{"observed_at":"2026-08-06T13:38:09.230423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:09.180727Z","title":"Stc antispoofing systems for the asvspoof2021 challenge,","venue":null,"work_id":"99f5378d-3c5b-450f-b935-4591b2f46825","year":2021},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:06.107221Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:eb42c62b0245b8ec24683ce992137e61d32bc211ea0f4cfaad0ddefb08e98f6d","observation_id":"e95b230c-ada7-4866-bcac-87a0b3192bc4","resolution":{"observed_at":"2026-08-06T13:38:09.189076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:06.282549Z","title":"Does audio deepfake detection generalize?","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:06.282549Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:c61a24fb5672d67afd65a827a465b0ad34a0fc1234c7394963109501e6ba14e8","observation_id":"9b51cb1d-c5fb-4547-ad31-a3662f4dd997","resolution":{"observed_at":"2026-08-06T13:38:06.282549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:09.155264Z","title":"A subnetwork approach for spoofing aware speaker verification","venue":null,"work_id":"4d57f63a-bbdf-4001-a4bb-9675aa8cd907","year":2022},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:06.437602Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:7be4920119038ae432b4462c02ab3d74aa278481ed156c050571a61429033735","observation_id":"b4fc27ca-89ee-4cd3-ada2-d1cbde1a1ade","resolution":{"observed_at":"2026-08-06T13:38:09.163374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:09.132469Z","title":"Pindrop labs’ submission to the asvspoof 2021 challenge,","venue":null,"work_id":"1b81abe0-5104-498b-972d-8790268ff7c4","year":2021},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:06.590284Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:cf52cc325b6ae879007220b46e4771774a532830d4b2337d7cfa9d6a125e5b3e","observation_id":"fe51722b-69a9-4c5d-a6bf-779cc6564c49","resolution":{"observed_at":"2026-08-06T13:38:09.138156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15389","last_updated":"2023-06-27T11:27:55Z","snapshot_observed_at":"2026-07-06T15:47:15.230195Z","submitted_at":"2023-06-27T11:27:55Z","title":"Multi-perspective Information Fusion Res2Net with RandomSpecmix for Fake Speech Detection","version":1},"cited_work":{"arxiv_id":"2306.15389","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.15389","snapshot_observed_at":"2026-08-06T13:38:08.301065Z","title":"Multi-perspective Information Fusion Res2Net with RandomSpecmix for Fake Speech Detection","venue":"cs.SD","work_id":"441e9afe-682f-4f30-9b50-f62c871e12cf","year":2023},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:06.761322Z"},"links":{"cited_paper":"/paper/2306.15389","citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:d1fb445979bee9cd8f2661245bf0a621e985cf014f6ec399ecafef3da304b5f2","observation_id":"8596d2f4-e5f1-4b93-b974-c3075132dca9","resolution":{"observed_at":"2026-08-06T13:38:08.306853Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.11326","last_updated":"2021-06-13T05:44:47Z","snapshot_observed_at":"2026-07-06T10:51:48.782057Z","submitted_at":"2021-03-21T07:39:20Z","title":"A Comparative Study on Recent Neural Spoofing Countermeasures for Synthetic Speech Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.11326","snapshot_observed_at":"2026-08-06T13:38:06.969803Z","title":"A comparative study on recent neural spoofing countermeasures for synthetic speech detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:06.969803Z"},"links":{"cited_paper":"/paper/2103.11326","citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:276676db95cbf97838a7e6e7d7c2c60eee54340dfe9a74fe0be7b28925ee6135","observation_id":"cf211e04-58a5-4682-8351-d5ab73d1f935","resolution":{"observed_at":"2026-08-06T13:38:06.969803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:09.109517Z","title":"Multi-scale permutation entropy for audio deepfake detection,","venue":null,"work_id":"59432e0a-c0a2-47bb-bcf3-795d5b1fc0aa","year":2024},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.126141Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:b4225a5d63639f7c6b2046b9fbce6581151cdd3f11790158a16ce8058a9c2cf8","observation_id":"05806b31-c943-46f5-ba6f-f9e1207e33ae","resolution":{"observed_at":"2026-08-06T13:38:09.117422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.12212","last_updated":"2021-10-06T14:07:22Z","snapshot_observed_at":"2026-08-07T00:08:21.694841Z","submitted_at":"2021-07-26T13:36:14Z","title":"Raw Differentiable Architecture Search for Speech Deepfake and Spoofing Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.12212","snapshot_observed_at":"2026-08-06T13:38:07.288465Z","title":"Raw differentiable architecture search for speech deepfake and spoofing detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.288465Z"},"links":{"cited_paper":"/paper/2107.12212","citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:99c768a1ed19e6ae89b868382e10dfa9a25c1621393e75d637110a9166ccc2ef","observation_id":"894cf0b2-270f-493e-bf18-f484c7a5b185","resolution":{"observed_at":"2026-08-06T13:38:07.288465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:09.088380Z","title":"Aasist: Audio anti-spoofing using integrated spectro- temporal graph attention networks,","venue":null,"work_id":"68d688fa-a1aa-42eb-9464-c794ef91830c","year":2022},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.450794Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:e1a8bf5790c26b7a2605be6f47cb5ab7c6995eef90c8917406dcc58be5bdfa24","observation_id":"3cce6773-ad62-4f04-a943-9edf0e44b560","resolution":{"observed_at":"2026-08-06T13:38:09.094616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:09.057099Z","title":"Learning a self-supervised domain-invariant feature representation for generalized audio deepfake detection,","venue":null,"work_id":"3c212262-156d-45d3-ba54-6b9e5c373add","year":2023},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.533761Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:8831642b39268413bc3350750e06381392a9ea586c54bfe1275eb55f3389fc90","observation_id":"da78c7bc-2d5c-4028-9c13-619be8d289e1","resolution":{"observed_at":"2026-08-06T13:38:09.062080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:09.036682Z","title":"Can large-scale vocoded spoofed data improve speech spoofing countermeasure with a self-supervised front end?","venue":null,"work_id":"f2675e71-a2ff-411f-8a28-cb2854980ff2","year":2024},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.539715Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:74d9ee3019dd067dd2cde968ac2c3feee3b12b193b622550a1445374675f5f6e","observation_id":"1b29d4da-c76d-4d65-ab9f-b0a2e7fb4f88","resolution":{"observed_at":"2026-08-06T13:38:09.043581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:09.004332Z","title":"A robust audio deepfake detection system via multi-view feature,","venue":null,"work_id":"e04aa788-54db-437a-9608-7d436a5d6f92","year":2024},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.544783Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:7cddb5ed71ff34fcc91dd7695594c3688455567dd00abf3e058f5db7ccc7c966","observation_id":"91a3e991-e27b-4aa9-9afc-e83c5e11d023","resolution":{"observed_at":"2026-08-06T13:38:09.013374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03512","last_updated":"2024-06-12T16:54:01Z","snapshot_observed_at":"2026-08-01T16:29:28.149959Z","submitted_at":"2024-06-05T10:33:15Z","title":"Harder or Different? Understanding Generalization of Audio Deepfake Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03512","snapshot_observed_at":"2026-08-06T13:38:07.549412Z","title":"Harder or different? understanding generalization of audio deepfake detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.549412Z"},"links":{"cited_paper":"/paper/2406.03512","citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:8a86540496f8069f2cefefa3c78bf624d8d62b0cb6aa0a7c8f8834dafcf89222","observation_id":"1daef9aa-786b-485b-bc07-94e7e4dbea71","resolution":{"observed_at":"2026-08-06T13:38:07.549412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02470","last_updated":"2022-04-18T22:17:50Z","snapshot_observed_at":"2026-07-06T12:57:12.674346Z","submitted_at":"2022-04-05T20:09:15Z","title":"Combining Spectral and Self-Supervised Features for Low Resource Speech Recognition and Translation","version":2},"cited_work":{"arxiv_id":"2204.02470","doi":null,"metadata_source":"pith","pith_arxiv_id":"2204.02470","snapshot_observed_at":"2026-08-06T13:38:08.207765Z","title":"Combining Spectral and Self-Supervised Features for Low Resource Speech Recognition and Translation","venue":"cs.CL","work_id":"4440ab5c-cf17-4797-bda7-5a96b9bcf425","year":2022},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.554274Z"},"links":{"cited_paper":"/paper/2204.02470","citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:fe2cb7b206de9ab5e7311685d3ed878be54cb7d9cb9cc4f38180b4a330a061a1","observation_id":"4e6268f9-8553-418b-aa2a-242365121455","resolution":{"observed_at":"2026-08-06T13:38:08.213805Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:08.975489Z","title":"Fine-tune pre-trained models with multi-level feature fusion for speaker verification,","venue":null,"work_id":"d3822d0f-7a6a-44f1-87a5-6ed7778da3ed","year":2024},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.559073Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:71330294ea3bf1eebdf71327b0991329e6f1d7ad5ff02aac9602a90f4a329317","observation_id":"37d7e988-cf34-4f70-ad6b-184e7e66109c","resolution":{"observed_at":"2026-08-06T13:38:08.981882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:08.953239Z","title":"Wave-spectrogram cross-modal aggregation for audio deepfake detection,","venue":null,"work_id":"7820644e-69e6-4141-a2eb-eee227f578f0","year":2025},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.563762Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:ee60a19dda4172be0ccfbd39091d8701df6995fcb9238edf68c88ef7072640e6","observation_id":"107fb94b-344a-4e7e-bb3f-2b7c221736ed","resolution":{"observed_at":"2026-08-06T13:38:08.961585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:08.933192Z","title":"Audio deepfake detection: What has been achieved and what lies ahead,","venue":null,"work_id":"e0139489-226c-4e76-b858-58a1101dd728","year":1989},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.568423Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:5b6a362baed2b2df467f3c16651d2fcafb59ec289758527a9e6914e833e95e0a","observation_id":"2cd51ad5-3014-4f6c-8d6d-995fbbe3bdf7","resolution":{"observed_at":"2026-08-06T13:38:08.938714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03559","last_updated":"2025-02-07T16:51:57Z","snapshot_observed_at":"2026-07-06T20:31:50.759186Z","submitted_at":"2025-02-05T19:17:24Z","title":"Comprehensive Layer-wise Analysis of SSL Models for Audio Deepfake Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03559","snapshot_observed_at":"2026-08-06T13:38:07.572963Z","title":"Comprehensive layer-wise analysis of ssl models for audio deepfake detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.572963Z"},"links":{"cited_paper":"/paper/2502.03559","citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:6207aa29326f427cfa52f66e9bcbf3ae502b24bff19c722b599a30316225cd73","observation_id":"77651e03-d715-409e-bb80-b8ae05b2dddf","resolution":{"observed_at":"2026-08-06T13:38:07.572963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:08.902701Z","title":"Asvspoof 2019: A large-scale public database of synthesized, converted and replayed speech,","venue":null,"work_id":"3bb905c5-d7ad-4423-8f37-99fa0ebbdac0","year":2019},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.578193Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:412f8a044d39a55d15e7a543f2a2d2436873cce53e7ffa534fff51d9040e5185","observation_id":"ef728ba4-672e-4f24-8429-0e1b6de0d2c8","resolution":{"observed_at":"2026-08-06T13:38:08.913918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:08.882249Z","title":"Asvspoof 2021: accelerating progress in spoofed and deepfake speech detection,","venue":null,"work_id":"80d43315-e859-4fa2-a464-6fa1383a7213","year":2021},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.583448Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:8be45b9911d6fbbf327b5423821f8d341386282ac1e0d9bacf88a3ebf7e30656","observation_id":"dc17621e-2339-467e-9e13-c27c1c168088","resolution":{"observed_at":"2026-08-06T13:38:08.887894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08739","last_updated":"2024-08-16T13:37:20Z","snapshot_observed_at":"2026-07-06T19:01:32.237848Z","submitted_at":"2024-08-16T13:37:20Z","title":"ASVspoof 5: Crowdsourced Speech Data, Deepfakes, and Adversarial Attacks at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08739","snapshot_observed_at":"2026-08-06T13:38:07.589387Z","title":"Asvspoof 5: Crowdsourced speech data, deepfakes, and adversarial attacks at scale,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.589387Z"},"links":{"cited_paper":"/paper/2408.08739","citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:decde4712477bfc24206f77e1f4cb6c5572421f5f82580ef4ece58cad81009f5","observation_id":"ce6c6bf8-12d5-4b2a-b8cd-1d1d92abf05f","resolution":{"observed_at":"2026-08-06T13:38:07.589387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:07.594737Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.594737Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:43b5d333a5072c34798ad33bfc16ce6c1d492573c82a21174d2eb203b9dafd44","observation_id":"fa8fa3d7-a5ea-4fc7-a53e-6a36bfc2c7e7","resolution":{"observed_at":"2026-08-06T13:38:07.594737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10838","last_updated":"2025-08-15T10:11:54Z","snapshot_observed_at":"2026-08-07T18:15:43.557946Z","submitted_at":"2025-02-15T16:02:54Z","title":"Generalizable speech deepfake detection via meta-learned LoRA","version":2},"cited_work":{"arxiv_id":"2502.10838","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.10838","snapshot_observed_at":"2026-08-06T13:38:08.095967Z","title":"Generalizable speech deepfake detection via meta-learned LoRA","venue":"eess.AS","work_id":"32b0143b-363d-4b38-9469-db71741cafa5","year":2025},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.606869Z"},"links":{"cited_paper":"/paper/2502.10838","citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:f4e8758c652bd58b1cebb7b0434de2d73d433ac8d51c01c43cc933c1b469617f","observation_id":"081b8180-686e-42a4-82d3-ac0acb7670b9","resolution":{"observed_at":"2026-08-06T13:38:08.105198Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:08.846771Z","title":"Constant q cepstral coefficients: A spoofing countermeasure for automatic speaker verification,","venue":null,"work_id":"f4382dc9-ff44-461b-b207-815179cabb93","year":2017},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.612940Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:fa7ab250ae7c4171dc6d6d6da816fea0778514b18bd2d4c5ed0a65d2e2e10edf","observation_id":"6f2e6426-85c2-4254-be69-37cd676508c9","resolution":{"observed_at":"2026-08-06T13:38:08.852212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:08.828271Z","title":"Anti-spoofing ensembling model: Dynamic weight allocation in ensemble models for improved voice biometrics security,","venue":null,"work_id":"49e9009d-0176-4770-ac4c-0da326902063","year":2024},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.618066Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:dfb313e316b594a62ae7ab766d8bb96aa48e53cee72a56b535f3110a6eecdf3f","observation_id":"abc846c9-5963-4ae3-936b-f3acb72ccde8","resolution":{"observed_at":"2026-08-06T13:38:08.834007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.12233","last_updated":"2022-02-28T11:50:57Z","snapshot_observed_at":"2026-07-06T12:41:22.635071Z","submitted_at":"2022-02-24T17:55:00Z","title":"Automatic speaker verification spoofing and deepfake detection using wav2vec 2.0 and data augmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.12233","snapshot_observed_at":"2026-08-06T13:38:07.623424Z","title":"Automatic speaker verification spoofing and deepfake detection using wav2vec 2.0 and data augmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.623424Z"},"links":{"cited_paper":"/paper/2202.12233","citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:27b7673e3d7f76cf3600305f707633d2ada8c4d9c21c47aa58c90c573a9c38d7","observation_id":"419e7594-2244-411f-a918-1f14a8b1f215","resolution":{"observed_at":"2026-08-06T13:38:07.623424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:08.805307Z","title":"Spoofed speech detection with a focus on speaker embedding,","venue":null,"work_id":"f4c223d9-1c21-491c-84f1-8f5575f70d71","year":2024},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.629332Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:8a3241b3d8bc3f7f6aeb38d87e125bbc1c5420ee14b8829058e2dbfc6d7d293f","observation_id":"219770b1-ddcc-4b03-a4cb-370d15bc8f21","resolution":{"observed_at":"2026-08-06T13:38:08.810285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:08.781697Z","title":"Slim: Style-linguistics mismatch model for generalized audio deepfake detection,","venue":null,"work_id":"104a11bf-9137-43cf-b806-0c9fe2895ac6","year":2024},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.635555Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:b4d830f432656e7f1208c0e59ea1b2ddeb8a19b98428060d8fd3690308b5c7b2","observation_id":"b4eb87f3-1b4c-424c-8cf1-f414e61c3b37","resolution":{"observed_at":"2026-08-06T13:38:08.789318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:08.762314Z","title":"Mixture of experts fusion for fake audio detection using frozen wav2vec 2.0,","venue":null,"work_id":"0bbf9f97-fb21-4eff-a000-d0acc837556d","year":2025},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.643180Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:619b03721f0f298d57e125ef5ebe599a416d8f0baa028c4fb0e988626ea30d5a","observation_id":"442ea67b-2e17-405a-97d2-355cb0ffd68e","resolution":{"observed_at":"2026-08-06T13:38:08.768294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17376","last_updated":"2024-06-25T08:50:43Z","snapshot_observed_at":"2026-07-06T18:36:38.636181Z","submitted_at":"2024-06-25T08:50:43Z","title":"Temporal-Channel Modeling in Multi-head Self-Attention for Synthetic Speech Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17376","snapshot_observed_at":"2026-08-06T13:38:07.648833Z","title":"Temporal-channel modeling in multi-head self-attention for synthetic speech detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.648833Z"},"links":{"cited_paper":"/paper/2406.17376","citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:a5f90488dc95a01a3167029fae1e49517d5a1115d159309323607652da654ced","observation_id":"4ef719b6-c518-42c7-973b-52d2a786f017","resolution":{"observed_at":"2026-08-06T13:38:07.648833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:07.653681Z","title":"Nes2net: A lightweight nested architecture for foundation model driven speech anti-spoofing,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.653681Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:eb287e543f4d3fe5e48c694279d07a432fec53d03d0231e64c0fdc2a680adce3","observation_id":"4819e8fa-7aba-40fc-9b17-44f9698a272a","resolution":{"observed_at":"2026-08-06T13:38:07.653681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:08.743396Z","title":"Rawboost: A raw data boosting and augmentation method applied to automatic speaker verification anti-spoofing,","venue":null,"work_id":"203f59e4-69ee-4075-828d-dd78c652ceb8","year":2022},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.659109Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:b8382327839252d98a126f9cc40815e31092bbe910880e7d8b367bae31eb51bb","observation_id":"8797b51a-e224-43b4-b910-34cd39a4175b","resolution":{"observed_at":"2026-08-06T13:38:08.749271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:38:08.724205Z","title":"Opensmile: the munich versatile and fast open-source audio feature extractor,","venue":null,"work_id":"18ba1a9b-430c-40a3-ad90-423ef69b9691","year":2010},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.664244Z"},"links":{"citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:1d3dc1b827b12e2d490eccad3a802e7b7acdedc85e3a698416c73e9314dcf831","observation_id":"a0d91cd0-c28d-42ac-a7f4-d7923f0e14ec","resolution":{"observed_at":"2026-08-06T13:38:08.730932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T13:38:07.600339Z","title":"Available: https://arxiv.org/abs/1412.6980","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T13:38:07.600339Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2507.20417"},"observation_digest":"sha256:2329e1db833092d898e356111ab327437dc0fbe50d9fe7987e1323caba862d61","observation_id":"985ed483-c526-4d45-afc0-8d683c54ed40","resolution":{"observed_at":"2026-08-06T13:38:07.600339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.20417","last_updated":"2025-07-27T21:22:27Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-06T13:38:03.705154Z","submitted_at":"2025-07-27T21:22:27Z","title":"Two Views, One Truth: Spectral and Self-Supervised Features Fusion for Robust Speech Deepfake Detection"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":3,"verified_fuzzy":26},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2507.20417."}