{"as_of":"2026-08-12T07:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:674ecd5a3fd0d524e0d6616fd20526f05b25b63398ddcea2348f1808915dd8b0","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T15:19:16.945988Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.14240/citation-record","integrity":"/paper/2501.14240/integrity","json":"/paper/2501.14240/citation-record.json","paper":"/paper/2501.14240"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.370621Z","title":"Asvspoof 2021: accelerating progress in spoofed and deepfake speech detection,","venue":null,"work_id":"01cc8f08-449d-4069-b38a-9377416ae949","year":2021},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.819278Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:14f8ce2ca8919d77d5ee6156a2e62a0ef58589c4bae6359088379534da311947","observation_id":"f4ab5ad9-80db-47e0-8e00-15b07b9ee209","resolution":{"observed_at":"2026-08-10T15:19:17.374998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.358634Z","title":"Does audio deepfake detection general- ize?,","venue":null,"work_id":"c8798bc9-a745-47ef-ab2e-70d0871c0b37","year":2022},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.824966Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:9de36993f2b55c9f2e3c89adc8a68c01120335ce8a3718c4deefaae2ad8a17c3","observation_id":"75f270bf-3aef-4350-af01-1a44b4b6510f","resolution":{"observed_at":"2026-08-10T15:19:17.362844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09296","last_updated":"2021-12-16T18:29:22Z","snapshot_observed_at":"2026-07-06T12:09:37.468149Z","submitted_at":"2021-11-17T18:49:42Z","title":"XLS-R: Self-supervised Cross-lingual Speech Representation Learning at Scale","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09296","snapshot_observed_at":"2026-08-10T15:19:16.830454Z","title":"Xls-r: Self-supervised cross-lingual speech representation learning at scale,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.830454Z"},"links":{"cited_paper":"/paper/2111.09296","citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:be67e390fe49dba16d026298f084d1eb9305db4ca0e83320f2239673e1e4cc2a","observation_id":"65005dab-19d1-429a-a61c-d2acf75a547f","resolution":{"observed_at":"2026-08-10T15:19:16.830454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.346147Z","title":"Robust speech recognition via large- scale weak supervision,","venue":null,"work_id":"7c1912b7-f8d4-40d4-9c2e-09888f60e3c2","year":2023},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.835896Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:bcb7d65b0e30977239a547bcd9f9a7b69d36e12f5ba48560582039d5668ff21c","observation_id":"4d2b43c0-2b3c-4467-86ea-99fb70b1cbe5","resolution":{"observed_at":"2026-08-10T15:19:17.350644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.332055Z","title":"Wavlm: Large-scale self-supervised pre-training for full stack speech processing,","venue":null,"work_id":"a97204fb-80a5-4413-9d12-1c30f71e7a2a","year":2022},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.841641Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:6bb62e1f646b8868c3fd98ea528bd6a0333124ef187509cb33723442488a5d6d","observation_id":"c17af724-086b-46f2-8a63-85a7cfdeb6a1","resolution":{"observed_at":"2026-08-10T15:19:17.336929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.318943Z","title":"Automatic speaker verification spoof- ing and deepfake detection using wav2vec 2.0 and data augmentation,","venue":null,"work_id":"ecc419f6-a3b3-44c2-afc2-d87610665f32","year":2022},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.846265Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:9c73d251296261ea638f1d12382cf14818172de8c849b935e28d6409242923b5","observation_id":"150935f9-d940-465a-9480-5d9b00d7bebb","resolution":{"observed_at":"2026-08-10T15:19:17.323271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.306980Z","title":"One-class learning towards synthetic voice spoofing detection,","venue":null,"work_id":"1ad89756-9993-4d48-a3b5-b768aef17190","year":2021},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.851819Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:27a575c4753dc50eee75b953c38440abb75084c84d8ad05b2fc8ec73b6aa924a","observation_id":"47f92122-13e3-4a8a-87f5-aa6a528cf8ad","resolution":{"observed_at":"2026-08-10T15:19:17.311249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.294453Z","title":"One-class learning with adaptive centroid shift for audio deepfake detection,","venue":null,"work_id":"1c7b7c72-2a61-4f94-ad58-dfe9ba38305d","year":2024},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.856409Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:50cfe1ad5de628237b0764bce441a58cd57299bc4e5ad42f5ddcdb8ddaacd3ca","observation_id":"6633d3b4-b7fc-413b-a30a-a153a3dc8c6c","resolution":{"observed_at":"2026-08-10T15:19:17.299126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08779","last_updated":"2019-12-03T18:19:07Z","snapshot_observed_at":"2026-08-11T22:56:31.055611Z","submitted_at":"2019-04-18T17:53:38Z","title":"SpecAugment: A Simple Data Augmentation Method for Automatic Speech Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08779","snapshot_observed_at":"2026-08-10T15:19:16.860363Z","title":"Specaugment: A simple data augmentation method for automatic speech recognition,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.860363Z"},"links":{"cited_paper":"/paper/1904.08779","citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:4a8eda931e2afd6e78179406d8a7c2bc1ab65a192ff9bbe80bf18aaf109f1cf6","observation_id":"817baa08-039e-4e67-92b3-105838da1f9c","resolution":{"observed_at":"2026-08-10T15:19:16.860363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.280244Z","title":"Rawboost: A raw data boosting and augmentation method applied to automatic speaker verification anti-spoofing,","venue":null,"work_id":"5cd6c8d2-353d-4dba-b71e-84b0bd9c4e29","year":2022},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.864933Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:80fe57938144a1f1bceb9626f16fa95fe5d65c3277af77caeaf0e94760d6f0bb","observation_id":"3af7edff-0330-4560-aba9-a5ae27725d2a","resolution":{"observed_at":"2026-08-10T15:19:17.285129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.267100Z","title":"Cpaug: Refining copy-paste augmentation for speech anti- spoofing,","venue":null,"work_id":"f449dcc4-5ac7-4dfd-8f99-78e74bceffd9","year":2024},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.868758Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:ebef67ad40fb6c198b2fb0b5f5aebb82c41838605ca291ce08e1075d551b956a","observation_id":"1d66677c-5167-4e7b-ab3f-545dedb10605","resolution":{"observed_at":"2026-08-10T15:19:17.271180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.255310Z","title":"Targeted augmented data for audio deepfake detection,","venue":null,"work_id":"2f654545-14e8-4a41-8210-c5a4fc3a85f2","year":2024},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.872845Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:f328d38465d72e21cc817c95a1e47b2d963acbd1607496f70c850eef99df14b3","observation_id":"2b58bf9a-b5b4-4990-831c-e0358b604e1f","resolution":{"observed_at":"2026-08-10T15:19:17.259475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.243296Z","title":"Spoofed training data for speech spoofing countermeasure can be efficiently created using neural vocoders,","venue":null,"work_id":"b917fb47-a0a8-40a5-96d0-d26dba229a75","year":2023},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.877382Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:0003e4009ef1b189458fc23a287f8db498c88bccae027e157ff56c71c34fafaa","observation_id":"a42e13e7-7086-432c-a41d-6ecc7240672b","resolution":{"observed_at":"2026-08-10T15:19:17.247527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.231285Z","title":"Can large-scale vocoded spoofed data improve speech spoofing countermeasure with a self-supervised front end?,","venue":null,"work_id":"cd37c244-c89c-4050-b3cd-a9210037b982","year":2024},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.881813Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:3c117d326da5e5bfd10e7ec7a5ef3d94757278572dd3b4b485dc2ed0350c5e62","observation_id":"0e58df77-f51e-4707-a8b9-e754b57fb1ac","resolution":{"observed_at":"2026-08-10T15:19:17.235269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.219690Z","title":"Data augmentation via latent space interpolation for image classification,","venue":null,"work_id":"d08ea21b-e40d-476c-a122-398c2adcb51a","year":2018},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.885486Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:e3d5ad821d70ac2d87faa5b3726d59cd7cae9b398d44f4759ea6837f82aa1145","observation_id":"309ca59f-685f-4bba-8b43-9af079e5986b","resolution":{"observed_at":"2026-08-10T15:19:17.223935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.208522Z","title":"Transcending forgery specificity with latent space augmentation for generalizable deepfake detection,","venue":null,"work_id":"5d890258-1cfa-42e0-9616-4601c2363027","year":2024},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.889217Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:8151a82cc1d823433ff9f89dd32109d7601f4c8ed029986dd90dc2d2735dc37a","observation_id":"6331fac3-6af0-4986-b0c1-50a9b3b90d0d","resolution":{"observed_at":"2026-08-10T15:19:17.212278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.196624Z","title":"Asvspoof 2019: A large-scale public database of synthesized, converted and replayed speech,","venue":null,"work_id":"32574f12-7222-4685-a3e7-ff14e4a8a234","year":2019},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.893033Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:673b7ba7db62f8c8389929fcbc8ecf97e104715dc301d57de2657026b0fb646f","observation_id":"f1663513-2597-44f3-a069-e291124e3181","resolution":{"observed_at":"2026-08-10T15:19:17.200917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.184688Z","title":"Arcface: Additive angular margin loss for deep face recognition,","venue":null,"work_id":"4ad9fb16-a487-41f5-85ce-c1e1085186be","year":2019},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.897170Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:508d094b1486db6946f09f6ffa569c717706a948d43afd2755858e0bf11ba08a","observation_id":"31c48fc3-dfd2-4b6c-8175-206b7bde356f","resolution":{"observed_at":"2026-08-10T15:19:17.188645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.09412","last_updated":"2018-04-27T21:39:25Z","snapshot_observed_at":"2026-08-08T10:28:19.597631Z","submitted_at":"2017-10-25T18:30:49Z","title":"mixup: Beyond Empirical Risk Minimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.09412","snapshot_observed_at":"2026-08-10T15:19:16.901021Z","title":"mixup: Beyond empirical risk minimization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.901021Z"},"links":{"cited_paper":"/paper/1710.09412","citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:4ff5e882d63d172bfe9300ab5c3743aed54d9eb361b1c0eb70e092ae0fe6b744","observation_id":"f7088b81-2a71-423c-8aea-defa19cb8a9e","resolution":{"observed_at":"2026-08-10T15:19:16.901021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.171320Z","title":"Aasist: Audio anti-spoofing using integrated spectro-temporal graph attention networks,","venue":null,"work_id":"6c41c308-5162-4726-ac4f-0b4975edc8d3","year":2022},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.906122Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:c83b85dfda1f103110c66c96a3cd0dfc490556ad886925dd15957c4c33089be3","observation_id":"6a61a2d5-8c0d-448d-91b1-47320ee94681","resolution":{"observed_at":"2026-08-10T15:19:17.176155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.156746Z","title":"Attentive merging of hidden embeddings from pre-trained speech model for anti-spoofing detection,","venue":null,"work_id":"4a500314-9d9a-497e-98cd-c608f7e3e663","year":2024},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.910796Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:18e84ab4b4fcd8415b8422fb1945924556f9a653fb1d7ca6339acc1d2b8a37ef","observation_id":"4161f9d7-699c-43db-b120-d2986c7d23a4","resolution":{"observed_at":"2026-08-10T15:19:17.162359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.140030Z","title":"Towards generalisable and calibrated audio deepfake detection with self-supervised representations,","venue":null,"work_id":"3f83b326-1d5f-40cd-be0b-e484cad80245","year":2024},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.914613Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:de5ce5c7c4f32b2ebc4aff10b2b5d0d83b2982eb79107f5206eddcb0799ff24e","observation_id":"e8253627-4868-4a2d-b2b2-0a70476345b7","resolution":{"observed_at":"2026-08-10T15:19:17.145703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.123598Z","title":"Audio deepfake detection with self-supervised wavlm and multi-fusion attentive classifier,","venue":null,"work_id":"c191dea0-633c-448d-a3f7-03f3bd49a68e","year":2024},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.918661Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:889fe5637b4f0ec1e0732451a89134e30e19f8bf3761b772fd8e942a2a9d650d","observation_id":"059900af-9176-4543-977c-c834a63ea0c2","resolution":{"observed_at":"2026-08-10T15:19:17.129484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.106774Z","title":"Anti- spoofing using transfer learning with variational information bottleneck,","venue":null,"work_id":"84953b2c-b7cf-4305-adb2-ae5425bfb228","year":2022},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.922523Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:f32cea4e9b5e07e44c7eaf8d8a91d791e522d5fb8aa95abd9df489b2798c013f","observation_id":"b54f9f97-552e-4d36-9bc4-bbd72053e26e","resolution":{"observed_at":"2026-08-10T15:19:17.113722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.090065Z","title":"One-class knowledge distillation for spoofing speech detection,","venue":null,"work_id":"4e8dc194-2efc-4670-a200-23fc5c5961dd","year":2024},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.926760Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:00c0e34cfee1917e83e38213cdbb5449e8ee0b7cbac55cd85e3ff33f516413a8","observation_id":"ccf43d89-8eb9-4f33-8ace-4cf15ebc9248","resolution":{"observed_at":"2026-08-10T15:19:17.095641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.072140Z","title":"Genuine-focused learning using mask autoencoder for generalized fake audio detection,","venue":null,"work_id":"c937f986-f8d3-4c0c-a1a0-7f9b20ba0d37","year":2024},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.931868Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:cf217374fa921e854455b8d0bee0d37307558aaa34f890567ba645274ff60f52","observation_id":"4e69b41a-3c8f-460b-b37b-cc764580e892","resolution":{"observed_at":"2026-08-10T15:19:17.078735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.055138Z","title":"Improving short utterance anti-spoofing with aasist2,","venue":null,"work_id":"9c3f4f7d-dff9-4b17-8143-adf91c7ee9d3","year":2024},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.936232Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:38bd79818a1b37407a6100913937c3b13b8227bb73b973e0c8023526e0db02a2","observation_id":"a0d44e82-8632-4aa0-8e35-f3e6e1a20158","resolution":{"observed_at":"2026-08-10T15:19:17.060150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.039014Z","title":"Temporal-channel modeling in multi-head self-attention for synthetic speech detection,","venue":null,"work_id":"c1d5113d-334e-4f26-b568-c4e6e8e2821c","year":2024},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.940761Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:bf5a2dd9c2b7f00926c7cb90ef34e12f1db5d12564d4e3c7b06107917f866aa6","observation_id":"e622b297-c04e-473b-a4af-2a924e295caa","resolution":{"observed_at":"2026-08-10T15:19:17.044882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:17.021959Z","title":"Spoofing speech detection by modeling local spectro- temporal and long-term dependency,","venue":null,"work_id":"9f44e6a4-2f99-4134-beff-7943a22105d8","year":2024},"citing_paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:16.945988Z"},"links":{"citing_paper":"/paper/2501.14240"},"observation_digest":"sha256:fba37cb51ac8ab3603595a4dc85f091bebdb77c51c2b57636d5b2b32c295893d","observation_id":"29c20cf2-8ec6-451c-81d9-96b022204f55","resolution":{"observed_at":"2026-08-10T15:19:17.029826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.14240","last_updated":"2025-01-24T04:54:08Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-11T00:14:06.674164Z","submitted_at":"2025-01-24T04:54:08Z","title":"Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2501.14240."}