{"as_of":"2026-08-08T13:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6b4c53cfac68fcde1db3eed62bc143901f22d32afbfe784948bcec803c32fd3e","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:50:16.986076Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.01750/citation-record","integrity":"/paper/2507.01750/integrity","json":"/paper/2507.01750/citation-record.json","paper":"/paper/2507.01750"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:23.258293Z","title":"Fbi warns of increasing threat of cyber criminals utilizing artificial intelligence,","venue":null,"work_id":"53154680-1021-4586-8375-39fe69436b71","year":2025},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.745745Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:1790fa65fe2fad28b68856f4017c5f1adf9d17b1ebc67378e46638e312188d31","observation_id":"0f70488c-eea8-41a3-8603-efa08e58d0a6","resolution":{"observed_at":"2026-08-06T20:50:23.339001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:23.122015Z","title":"Pay-to-play: Access to justice in the era of ai and deep- fakes,","venue":null,"work_id":"38f2406e-0c22-4cf4-a1e4-5153fb910c93","year":2025},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.751337Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:456915b116031966635f65be53cebe5469c096928bef389995cd22e3bfb78772","observation_id":"32025b7f-36f3-4268-aea7-dd5cce59e3e7","resolution":{"observed_at":"2026-08-06T20:50:23.191862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:23.012383Z","title":"Asvspoof 2015: the first automatic speaker verification spoofing and countermeasures challenge,","venue":null,"work_id":"cdb5946f-af07-4b59-8f26-796e971783f4","year":2015},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.755997Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:d85952c4dd35308bb22524cdd9e13b12012c22eb50316396450a8649d293f1f2","observation_id":"06479550-9fef-4425-8dc8-18f2993a67e3","resolution":{"observed_at":"2026-08-06T20:50:23.068828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:22.884276Z","title":"Automatic speaker verification spoofing and countermeasures challenge (asvspoof 2015) database,","venue":null,"work_id":"d4e9e2b1-82d6-434e-83b5-0b1a8802393e","year":2015},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.760586Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:9aa674eff54d75749c5ef3a0392c28b7b591c1e68165612ddb29aa0f8ea535e1","observation_id":"b3b5ad94-bff8-41a4-a49c-4e0e762322ff","resolution":{"observed_at":"2026-08-06T20:50:22.945158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:22.741129Z","title":"The asvspoof 2017 challenge: Assessing the limits of replay spoofing attack detection,","venue":null,"work_id":"8169cb07-37de-4d3e-89d4-9150f4c07349","year":2017},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.765295Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:be4290783bec7d3519b7990870e433ad2a89dc6a5d10fb9f03e587189faf20bd","observation_id":"8c0cd200-f89f-4568-bb40-e7f9a542a1ef","resolution":{"observed_at":"2026-08-06T20:50:22.801167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:22.627922Z","title":"The 2nd automatic speaker verification spoofing and countermeasures challenge (asvspoof 2017) database, version 2,","venue":null,"work_id":"5d05d27d-6da8-4594-a47d-f6c97c21c8cc","year":2017},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.769857Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:30ad5337d3e24f8a5579ada1d1586938908597cf55e9a48b4eb27494193efaea","observation_id":"74beae96-f75d-46c1-bf98-92d158a7263b","resolution":{"observed_at":"2026-08-06T20:50:22.663959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:22.477882Z","title":"ASVspoof 2019: Future Horizons in Spoofed and Fake Audio Detection,","venue":null,"work_id":"824882a5-33d3-452f-8d4e-d3946e6c9f66","year":2019},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.774669Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:90a088b64422276a1a9be5319517d8bcc57a56150b7a5f9f3cdb79e0bce821df","observation_id":"3c1c70d2-1b4f-4932-ac52-94d6914b7abb","resolution":{"observed_at":"2026-08-06T20:50:22.504721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:22.347601Z","title":"Asvspoof 2019: The 3rd automatic speaker verification spoofing and countermeasures challenge database,","venue":null,"work_id":"277ad20d-d3f2-4225-8c79-94de24e1bf4d","year":2019},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.778982Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:cc36694a6e6d2c20334c42d1e793eddb968959b84913c9cfa9c58c8fde356729","observation_id":"42690f01-465a-434d-b1fc-7b49ed2b773e","resolution":{"observed_at":"2026-08-06T20:50:22.391927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02437","last_updated":"2023-06-22T13:00:56Z","snapshot_observed_at":"2026-07-06T14:00:05.253488Z","submitted_at":"2022-10-05T17:57:29Z","title":"ASVspoof 2021: Towards Spoofed and Deepfake Speech Detection in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02437","snapshot_observed_at":"2026-08-06T20:50:16.783557Z","title":"ASVspoof 2021: Towards Spoofed and Deepfake Speech Detection in the Wild,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.783557Z"},"links":{"cited_paper":"/paper/2210.02437","citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:6f57cf6380f6e2a1b0d43b418979c2a4c313021f2c9936910240433ec248f84e","observation_id":"9e350314-1a0c-4a9c-9428-0e6585f295ff","resolution":{"observed_at":"2026-08-06T20:50:16.783557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"record/4837263","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:17.316249Z","title":"Asvspoof 2021 challenge - logical access database,","venue":null,"work_id":"b0724a82-4413-4c79-95e5-7dfe163cc080","year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.788351Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:9fe360956674ce636f122ba41a2aa936addab55e7b423faac5824bb8f88c49b4","observation_id":"d9741157-32ba-4216-8375-4721f9a4da9d","resolution":{"observed_at":"2026-08-06T20:50:17.331614Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"record/4834716","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:17.232815Z","title":"Asvspoof 2021 challenge - physical access database,","venue":null,"work_id":"e8b07322-25b2-417c-95bd-8905b172cb08","year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.792897Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:1eaf825679d986b7f0318254ba256c4390f53e2c46043920cc064b5a4cf7489d","observation_id":"df2c3136-89d4-4e8a-b647-5e4902504f2e","resolution":{"observed_at":"2026-08-06T20:50:17.240874Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"record/4835108","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:17.153762Z","title":"Asvspoof 2021 challenge - speech deepfake database,","venue":null,"work_id":"ef578550-1d1f-4c3b-a8cb-6c5e6764dfd7","year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.797652Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:eb353f65a09ce93bc8c787162b6bab116e52ed6e68074bca74851d9050147ae5","observation_id":"3314f024-a785-4c11-bc5e-663238402d9f","resolution":{"observed_at":"2026-08-06T20:50:17.163391Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08739","last_updated":"2024-08-16T13:37:20Z","snapshot_observed_at":"2026-07-06T19:01:32.237848Z","submitted_at":"2024-08-16T13:37:20Z","title":"ASVspoof 5: Crowdsourced Speech Data, Deepfakes, and Adversarial Attacks at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08739","snapshot_observed_at":"2026-08-06T20:50:16.802078Z","title":"Asvspoof 5: Crowdsourced speech data, deepfakes, and adversarial attacks at scale,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.802078Z"},"links":{"cited_paper":"/paper/2408.08739","citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:41fb7bda60729179e87f4614939acba4306c7b06976f8ffedd5c3afba8fb2719","observation_id":"f1fde9ea-1f3b-4407-84d4-dbff35c66b3c","resolution":{"observed_at":"2026-08-06T20:50:16.802078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.14498691","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:22.198219Z","title":"Asvspoof 5: Design, collection and validation of resources for spoofing, deepfake, and adversarial attack detection using crowdsourced speech,","venue":null,"work_id":"0aa9feba-f8cd-4bfa-b8a2-4550391afc3a","year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.807883Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:f60ca5bdb1ff38ce30f16a7f3958859c7b6f3852e09efb0193b8a67306095fe8","observation_id":"d8f3e947-4b8b-42a0-909b-192a8b55a19b","resolution":{"observed_at":"2026-08-06T20:50:22.284049Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:21.983671Z","title":"Add 2022: the first audio deep synthesis detection challenge,","venue":null,"work_id":"d59b7ea2-838e-4bc5-8a70-ff782c71546e","year":2022},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.812117Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:09512399bf2f8ddff1d59bbbfcb5efa030aa61fe41d9ca808ad47df3bb9aaf9b","observation_id":"c9d0aadb-3b4c-4452-b57f-9edd7744a166","resolution":{"observed_at":"2026-08-06T20:50:22.076228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:21.826588Z","title":"Does audio deepfake detection generalize?","venue":null,"work_id":"a2cfaa6c-7098-4356-b17a-83cc5c5672be","year":2022},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.817113Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:aa6499ea5e259f47fe4bf2b25102df4385d238bbb5c1a9dff84827a32b429a8a","observation_id":"d77b73d3-736b-4c1f-842e-d09e78632e18","resolution":{"observed_at":"2026-08-06T20:50:21.878283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:21.598138Z","title":"Dataset artefacts in anti- spoofing systems: A case study on the asvspoof 2017 benchmark,","venue":null,"work_id":"4e195cdf-e2b8-4931-95a3-cc7078773fa7","year":2017},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.821782Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:5ba7a679da5d497eb5d4391f1f4ef2e9b497794cef37a8c10b43b71a147153c9","observation_id":"dbf91de0-2c76-4997-ba74-baa66a3b79a8","resolution":{"observed_at":"2026-08-06T20:50:21.680081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:21.441766Z","title":"The effect of silence and dual-band fusion in anti-spoofing system,","venue":null,"work_id":"3a232f3d-3cc9-487d-bf41-dabdb9c81d9b","year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.827105Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:792f8212db4d1216625150995cbc253aee043210e09d43ce05d1ed51013c200c","observation_id":"8d115779-de40-45f2-a941-38f1889364d2","resolution":{"observed_at":"2026-08-06T20:50:21.497630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:21.102558Z","title":"Speech is silver, silence is golden: What do asvspoof- trained models really learn?","venue":null,"work_id":"2104d9aa-aaed-4295-b830-0fa734756be7","year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.831773Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:7004bca0c711bfb20a5a684b455aa6201b94b5f6f456341faab566f907d5da81","observation_id":"0466529b-99dd-4381-8b0b-dc252eef9255","resolution":{"observed_at":"2026-08-06T20:50:21.261435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:20.884315Z","title":"Investigating self-supervised front ends for speech spoofing countermeasures,","venue":null,"work_id":"16b9c519-cb2d-4961-ab4f-477423f9c827","year":2022},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.836075Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:4fcea6b0acf2acb32ded82b499e15a22c2e2f99b0dcba24a9a080c353229891e","observation_id":"10388cf0-b1f2-49a4-a716-0ad16d963502","resolution":{"observed_at":"2026-08-06T20:50:20.981115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:20.755613Z","title":"Does audio deepfake detection generalize?","venue":null,"work_id":"dec7ca69-c138-45f9-a99a-622bf2a69056","year":2022},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.840516Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:6779c71ef59062a76906ba09d1ede51c6be68973be1ddd4b14d182f61db4aeaa","observation_id":"185e1814-3f7d-4e73-b2da-b486529d3b0a","resolution":{"observed_at":"2026-08-06T20:50:20.796448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:20.581171Z","title":"The m-ailabs speech dataset,","venue":null,"work_id":"93ac0a63-ef38-442c-9465-31b338d13ddf","year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.845734Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:6f5e5258f90cae5a459cf33e0c0665c47ac7c1f482f0fa864b1f5f80701d9aa6","observation_id":"986a95c6-4590-4415-859d-1ba95bf1ea35","resolution":{"observed_at":"2026-08-06T20:50:20.649076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:16.850485Z","title":"Mlaad: The multi- language audio anti-spoofing dataset,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.850485Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:786f0b71ec96028747f3046141198b6109c44b2e08f5d69f8077a21b07e94f6b","observation_id":"cf5adb1d-55ff-4a3a-81ae-0504bcdfcdfe","resolution":{"observed_at":"2026-08-06T20:50:16.850485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:20.418267Z","title":"Deepfake de- tection challenge,","venue":null,"work_id":"dfc1f211-bf39-4677-8960-6b35fdc958ea","year":2019},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.855182Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:4d4ac4dee2c36488fcdb5f88bacfc9e8463378b70bcbf1edbb00b94cf847c1d7","observation_id":"5036f07c-6f49-4ca6-bf31-a1e50c72d5f3","resolution":{"observed_at":"2026-08-06T20:50:20.490890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:16.859634Z","title":"FakeA VCeleb: A novel audio-video multimodal deepfake dataset,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.859634Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:439f2c6361c9e515b2d99a27a32ec66224a46e38548f26663ce1c36e70028b64","observation_id":"324cee1f-2cb8-4fc5-abb0-5e7da24f6085","resolution":{"observed_at":"2026-08-06T20:50:16.859634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:20.167559Z","title":"Dfdc video audio labels,","venue":null,"work_id":"fe5c6bad-fe8a-4f72-bdee-d71c78be5d52","year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.864130Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:95d3ddc509b83c0d2cfd408d4fa21400a167fff4c8e5dbbcf915746598bfb594","observation_id":"92f81717-fdf0-4835-ba3f-4af946b064ed","resolution":{"observed_at":"2026-08-06T20:50:20.246787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:20.048239Z","title":"SPEECON – speech databases for consumer devices: Database specification and validation,","venue":null,"work_id":"80bfba7c-194e-456b-9813-e68a8f128187","year":2002},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.868686Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:cf0d9dc5c11ea02856399c12138abceff474430ec4c952e3d42926d37bd88fae","observation_id":"71efe77a-c01f-4854-ad0e-fd12fd30b61f","resolution":{"observed_at":"2026-08-06T20:50:20.094188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:16.873419Z","title":"Silero vad: pre-trained enterprise-grade voice activity detector (vad), number detector and language classifier,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.873419Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:1b6a079d2b0250e643b2bb60bf3bb7888e0966f6ddfc0447ae1461d8fbaade02","observation_id":"2338ea49-b3a9-4991-b8cd-83cc2037da96","resolution":{"observed_at":"2026-08-06T20:50:16.873419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:19.931329Z","title":"Spoofed training data for speech spoofing countermeasure can be efficiently created using neural vocoders,","venue":null,"work_id":"d214f545-09ee-469c-8507-407f939c72ea","year":2023},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.878045Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:bc0e21a05f0a3a0bc8e26e647c3890249c67d4f351e742a854af801bb897dc06","observation_id":"20c55ea7-3769-4713-a5cd-45f635942fdd","resolution":{"observed_at":"2026-08-06T20:50:19.969945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:19.820214Z","title":"Hugging face,","venue":null,"work_id":"7c630a5d-ee85-46c2-a953-1d07f166368d","year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.882421Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:88a64dc4cd2bac932ed79ffa3e5f35bc0d80c7feda2ef145eecd554e42d5c89a","observation_id":"c9d31b9f-5001-4059-b481-ec347d10cf32","resolution":{"observed_at":"2026-08-06T20:50:19.862615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:19.699061Z","title":"Hifi-gan: Generative adversarial networks for efficient and high fidelity speech synthesis,","venue":null,"work_id":"056de369-3d27-41ab-a105-b5b84f2d3c67","year":2020},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.886910Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:2fd8408b538c90604852e107045744bc353a088105bed6977aa66b6d86b68079","observation_id":"3769c3d5-1217-47cf-b35b-1fde16751b41","resolution":{"observed_at":"2026-08-06T20:50:19.751014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:19.599040Z","title":"Melgan: Generative adversarial networks for conditional waveform synthesis,","venue":null,"work_id":"663b7267-9084-4063-8512-3867c4783e8e","year":2019},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.891608Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:7a6d47deb586637c2817f5903f8173abde96bbc22d578dceb4b05a6b398d9fe8","observation_id":"89c499ac-be46-4d53-b9f7-f61ca944f52e","resolution":{"observed_at":"2026-08-06T20:50:19.643729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:19.511509Z","title":"World: A vocoder- based high-quality speech synthesis system for real-time applications,","venue":null,"work_id":"9aa11ad3-2a11-483d-9eae-9854aafa978e","year":2016},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.895938Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:59f1e07b424e41a9059477571791b07d54e0e53c974013b2f9bd864f196b2d06","observation_id":"1cabab34-cf5c-46d6-b414-46e6ac8c3086","resolution":{"observed_at":"2026-08-06T20:50:19.548369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:19.410354Z","title":"Waveglow: A flow-based generative network for speech synthesis,","venue":null,"work_id":"17a47caf-ec87-4bb7-b535-a67b36a02248","year":2018},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.900487Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:7618ff013e0f36d807c5aa5f2b38713d9c9fc75de314bb724d2e9e1cd2f84222","observation_id":"f2fe1ac6-b347-42c5-b39f-be58d14988b0","resolution":{"observed_at":"2026-08-06T20:50:19.448921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:19.302051Z","title":"Neural Source-Filter Wave- form Models for Statistical Parametric Speech Synthesis,","venue":null,"work_id":"c633ab6d-3a81-41c2-b36b-d0ebfc291ebf","year":2020},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.904730Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:484a34cc4446996afbc2ea86e2a392416ce654fb2d2d227a9078f2ea0336041e","observation_id":"fc3560d7-174c-4d2d-b8e8-2fc9d173f1c2","resolution":{"observed_at":"2026-08-06T20:50:19.346798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:19.189771Z","title":"Can large-scale vocoded spoofed data improve speech spoofing countermeasure with a self-supervised front end?","venue":null,"work_id":"f914f0a9-f1a8-4b74-9f70-d67139c765a9","year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.909348Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:dc5ee1a5156f189e95b114827785b8f0a54bb71bf9bdaa87f2147639cd784986","observation_id":"e071f367-c5cc-4483-8f30-3ef9d1be8b84","resolution":{"observed_at":"2026-08-06T20:50:19.254459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:19.082572Z","title":"The lj speech dataset,","venue":null,"work_id":"f5c4a63f-aa3d-4a8e-97a3-0eba0b4618c0","year":2017},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.913650Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:1338d562272fdedd7c2f11e3cac791b6d6bb14094c4ff74f6e00b378254fa854","observation_id":"50f5bd35-edae-4412-a2bf-0655ac9e0131","resolution":{"observed_at":"2026-08-06T20:50:19.135544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:18.970999Z","title":"fairseq: A fast, extensible toolkit for sequence modeling,","venue":null,"work_id":"d64f454a-e514-49f8-8c9e-2af2841fd94b","year":2019},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.918855Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:fd6834b73205b09cbd61c021959d35136c19f0535f1c3732c17699b0cb273583","observation_id":"fb347732-0a6f-4212-8db8-05a46721b0ac","resolution":{"observed_at":"2026-08-06T20:50:19.013277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:18.844936Z","title":"Stc antispoofing systems for the asvspoof2021 challenge,","venue":null,"work_id":"612d9882-ccd2-4dfa-b54e-932d20e61c97","year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.923404Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:5f5c46ea8790faff2a75d8ef1741fd1dd609dce46ac2578130e5875955eb03bd","observation_id":"c61f8662-0d1c-45ab-bb2f-9377a2f3b748","resolution":{"observed_at":"2026-08-06T20:50:18.911561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:18.723270Z","title":"Averaging weights leads to wider optima and better generalization,","venue":null,"work_id":"b5abcdcb-8b82-49c2-881f-f138ac5ac061","year":2019},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.928650Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:f8997cc60f8369ba9135e23d0c563d1da649f054241bc3bc31c9a247f689c452","observation_id":"7cde1841-c8da-46c6-9ba2-23adf4acaa32","resolution":{"observed_at":"2026-08-06T20:50:18.772247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:18.572943Z","title":"Focal loss for dense object detection,","venue":null,"work_id":"a70617f3-45b7-4e51-a966-525589958270","year":2018},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.933151Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:2d92147901dd4bb8b44ca76e05ed9d4e9b2493d111a29e6d7b70783e2240916e","observation_id":"c388115b-0a68-476d-886f-82cbcb33909c","resolution":{"observed_at":"2026-08-06T20:50:18.642389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:18.394115Z","title":"A discriminative feature learning approach for deep face recognition","venue":null,"work_id":"7db551c3-446a-4da5-b4cb-9d526185cc73","year":2016},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.938043Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:cba6a43e63042c307bf9ceb3663dbd7d4af4332b581cdbc3bfeb6f97923e4732","observation_id":"186616aa-2745-4f11-9750-f023fc645983","resolution":{"observed_at":"2026-08-06T20:50:18.485513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:18.243240Z","title":"One-class learning towards synthetic voice spoofing detection,","venue":null,"work_id":"a3c613f4-e5c4-412c-adf3-5a8b7ecffe3b","year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.942691Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:041b1badbea5001730e77dee1e3621625a3f368f4b86ee53fa9ea6f65bf9a554","observation_id":"ddbdbac7-5648-4f65-b5f6-b413c3a218e0","resolution":{"observed_at":"2026-08-06T20:50:18.294235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:18.071671Z","title":"Asvspoof 2021: Towards spoofed and deepfake speech detection in the wild,","venue":null,"work_id":"4939bcc5-a016-4d07-ba0b-950b3d1dd5ab","year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.947773Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:eadeea9fa0e89a544f42cab9cd0a4e74d570acf7f35e549129133f673ceacca5","observation_id":"7e9744ca-d05a-4da3-b928-07d5190864ff","resolution":{"observed_at":"2026-08-06T20:50:18.163224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:17.914064Z","title":"Rawboost: A raw data boosting and augmentation method applied to automatic speaker verification anti-spoofing,","venue":null,"work_id":"1573ae09-2c98-4cd2-9664-a342afdba96d","year":2022},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.952065Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:f22b13b113d905ebbc05b49219c0aec006050edcb4e7202a51bb4244ac877b42","observation_id":"38d45f89-8b0b-4404-a903-129cb51c18e2","resolution":{"observed_at":"2026-08-06T20:50:18.001991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:17.715545Z","title":"A binaural room impulse response database for the evaluation of dereverberation algorithms,","venue":null,"work_id":"523c7a97-5bbe-473a-bf31-98b304df693f","year":2009},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.956673Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:55b2ae5aaa3aeff2bc177d6d5a40e3e0d1973c35e584e1b0cc4ee022e457f67c","observation_id":"537dce94-5783-4dcc-872b-5edc014087d4","resolution":{"observed_at":"2026-08-06T20:50:17.807239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:17.624539Z","title":"Ustc-kxdigit system description for asvspoof5 challenge,","venue":null,"work_id":"db9ad77a-434c-4ee1-b44f-b35cce7c45f3","year":null},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.961972Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:092e79fe8c412771e77bdcad211c0fb99eaf75ded1e5e7e76cbbb178b05e237e","observation_id":"9e12b4eb-8065-404b-b37e-6780049b66c3","resolution":{"observed_at":"2026-08-06T20:50:17.653535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13438","last_updated":"2022-10-24T17:52:02Z","snapshot_observed_at":"2026-08-03T16:47:47.192907Z","submitted_at":"2022-10-24T17:52:02Z","title":"High Fidelity Neural Audio Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13438","snapshot_observed_at":"2026-08-06T20:50:16.971975Z","title":"High fidelity neural audio compression,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.971975Z"},"links":{"cited_paper":"/paper/2210.13438","citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:825046c258e2cf46757f2885a6d11e14672d305c2af7af0c3b7b42c97a64db37","observation_id":"42cb75f9-39b7-423c-bb7c-3bc589e478c5","resolution":{"observed_at":"2026-08-06T20:50:16.971975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:17.450542Z","title":"Probabilistic outputs for support vector machines and comparisons to regularized likelihood methods,","venue":null,"work_id":"4c0ac576-7221-4886-93d9-692b26879c8d","year":1999},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.976695Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:76443d9cf51334c559716510915296edaebbbd404aab2fca540280847a4429c9","observation_id":"54d9c851-8eb9-44ad-8477-7b4a0b123ee4","resolution":{"observed_at":"2026-08-06T20:50:17.537242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:17.404867Z","title":"Towards measuring fairness in speech recognition: Fair-speech dataset,","venue":null,"work_id":"c748d2d6-d0dd-44a2-a5f7-b63498baf124","year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.981021Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:1d20d11cf95144c6a443a5e4756629eef16f06f3a60c92d42edf36e8974b7c5b","observation_id":"41011f27-23cf-42fb-95ac-dfee072b23b0","resolution":{"observed_at":"2026-08-06T20:50:17.419346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:17.366135Z","title":"Torchaudio-squim: Reference-less speech quality and intelligi- bility measures in torchaudio,","venue":null,"work_id":"202993ef-991c-4070-9aba-7ee30e66da7b","year":2023},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.986076Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:a8c9b8ac978d410c6e4c5c2ef49ea642cd89823405a06e43edf937a6c18972af","observation_id":"95796c49-dddb-4e52-a0e9-09eb7ba09949","resolution":{"observed_at":"2026-08-06T20:50:17.378615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01695","last_updated":"2024-09-03T08:28:58Z","snapshot_observed_at":"2026-07-06T19:09:36.622509Z","submitted_at":"2024-09-03T08:28:58Z","title":"USTC-KXDIGIT System Description for ASVspoof5 Challenge","version":1},"cited_work":{"arxiv_id":"2409.01695","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.01695","snapshot_observed_at":"2026-08-06T20:50:17.039193Z","title":"USTC-KXDIGIT System Description for ASVspoof5 Challenge","venue":"cs.SD","work_id":"fa8177f3-66da-4a59-a184-7b4668ddc336","year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.966998Z"},"links":{"cited_paper":"/paper/2409.01695","citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:2bfa1a21b2cd5d6cd122568139a756bdd26b875cd7a575dac42607b3e1ba829e","observation_id":"edbd3f11-7325-4290-ba3c-e61b03cb593d","resolution":{"observed_at":"2026-08-06T20:50:17.046952Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-06T20:41:11.368195Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":6,"verified_exact":4,"verified_fuzzy":41},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2507.01750."}