{"as_of":"2026-08-20T00:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3f5f2db25cd58707ce3a00ffa5123819c20f4d3981539fc0a8732c98f80cbfde","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T21:03:50.616649Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.09167/citation-record","integrity":"/paper/2411.09167/integrity","json":"/paper/2411.09167/citation-record.json","paper":"/paper/2411.09167"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.353358Z","title":"Deepfake detection: Current challenges and next steps,","venue":null,"work_id":"3ddb17c1-be7f-4b9a-8abe-172fbbd485da","year":2020},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.398544Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:d8947d04476a884b6d58ea13e4d4733fe75146da6ffa93397317294fe6e72bd9","observation_id":"aebfcad1-9433-4e40-a47d-b7152ce54428","resolution":{"observed_at":"2026-08-12T21:03:51.357406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.338691Z","title":"Deepfake generation, detection and datasets: a rapid-review,","venue":null,"work_id":"792a0b5b-885c-4b91-b5f3-16e706291715","year":2022},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.403616Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:79e625a7968e798c26bd954dc5225f14ce1efdd8b2dc3abc0883d96b7b160a44","observation_id":"04d81a3e-1812-4ca5-a923-c132e258baa5","resolution":{"observed_at":"2026-08-12T21:03:51.345615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.326296Z","title":"Listen to This Deepfake Audio Impersonating a CEO in Brazen Fraud Attempt,","venue":null,"work_id":"53a41327-586b-41a3-8f82-133df0af62e8","year":null},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.407637Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:3c535458f3809609403384355a4c5670fecd60946e5bd2f6b3db91ef597e2f45","observation_id":"fe50a0c5-b082-48ba-bb03-de58ac6e9cf2","resolution":{"observed_at":"2026-08-12T21:03:51.330605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.304538Z","title":"Telegram Still Hasn’t Removed an AI Bot That’s Abusing Women,","venue":null,"work_id":"c47b28e4-0618-4a98-9de0-d2fb03440b61","year":2020},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.415634Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:05398ccabfee7f7427e8509ec224b66c5b2f55d15f2c80a8c6a1e25717253941","observation_id":"ea2b6ddd-123f-4f30-8fff-2f9b12a22a5f","resolution":{"observed_at":"2026-08-12T21:03:51.308724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.419374Z","title":"WaveFake: A Data Set to Facilitate Audio Deepfake Detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.419374Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:3ad83443026f176eeaea8b922f23e24a8c62ad5f18fe45c9a77442d711806cdb","observation_id":"621e5e9a-dc45-4d07-a193-8b4b647e461b","resolution":{"observed_at":"2026-08-12T21:03:50.419374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.288265Z","title":"P-flow: A fast and data-efficient zero-shot tts through speech prompting,","venue":null,"work_id":"389486db-c18a-4342-a6da-44b79a5f986a","year":2024},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.423466Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:ac6c3d69abc8f278caa6d36a1ca4e97d94cca5cab2c0aa486261b1790bd41041","observation_id":"e2525813-e802-404b-883e-b07e413f2542","resolution":{"observed_at":"2026-08-12T21:03:51.291366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.276574Z","title":"Phoneme hallucinator: One-shot voice conversion via set expansion,","venue":null,"work_id":"3bc35495-1924-45d8-b144-a90bf61706fb","year":2024},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.427580Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:b8498dcb281ec072e658cd5a73e942773fb23b32011f6c1dc95acf5932d075e7","observation_id":"48931689-c0c4-4b8c-979b-a394767daa44","resolution":{"observed_at":"2026-08-12T21:03:51.281101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.265383Z","title":"A review of modern audio deepfake de- tection methods: challenges and future directions,","venue":null,"work_id":"e7ce2f23-b74a-4174-a05a-11ace83d1507","year":2022},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.430772Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:719e5ffacf707cef3482d9f11c82e5d5883e4ac3a5b341f6628f39040e2a5d81","observation_id":"20c01067-5c2c-43c7-8102-78cab9e1b8db","resolution":{"observed_at":"2026-08-12T21:03:51.269265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.253977Z","title":"AI-Synthesized V oice Detection Using Neural V ocoder Artifacts,","venue":null,"work_id":"4511ee04-e1d5-4656-9177-845070aff75a","year":2023},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.434038Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:47d3f76d456a60db760078a53b2b4f38bdd90c6152fefa359d8eecd044aaf284","observation_id":"b7875bd8-8415-4c32-81c4-2c5575b9a0ee","resolution":{"observed_at":"2026-08-12T21:03:51.258527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.242872Z","title":"Spoofing speech detection using modified relative phase information,","venue":null,"work_id":"39849c7a-805d-4ed3-bbf6-34f21a4acead","year":2017},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.437550Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:94ab05fbebc588df38b410090729950572c75e83bc47b8c27782674a1891ebfa","observation_id":"b28150f5-6399-4659-bec9-a4a786d59fd6","resolution":{"observed_at":"2026-08-12T21:03:51.246833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.231607Z","title":"Robustness of speech spoofing detectors against adversarial post-processing of voice conversion,","venue":null,"work_id":"2eebde4f-0df9-474d-af37-32be3ed5d1ff","year":2021},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.440645Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:17495f55340d4b2656d7af3cf4ae4a55a43a04bf74b58ba7bfb4700ab4bb52ee","observation_id":"bbf5cfda-d9e3-4104-a3b2-6ea9b950bacd","resolution":{"observed_at":"2026-08-12T21:03:51.235653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.219795Z","title":"Detecting spoofed speeches via segment-based word cqcc and average zcr for embedded systems,","venue":null,"work_id":"2ae9f6ad-7d3d-4385-8491-1eaccf16a865","year":2022},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.443997Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:e0e1f9aa8e52b3487b6ceafecc827e8b668bc85cda44c72d0f1b4656539f05c8","observation_id":"8ca4d97b-15e5-40ec-89f5-c4af54fdeb7c","resolution":{"observed_at":"2026-08-12T21:03:51.223857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.447559Z","title":"Detecting ai-synthesized speech using bispectral analysis","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.447559Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:66c071b592a25fd9a21ec8882b60422b3b2f902f825220dd8439707d987a95bc","observation_id":"b61c2bb1-17dc-4007-aa1c-be2b67282926","resolution":{"observed_at":"2026-08-12T21:03:50.447559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.201628Z","title":"Fake Audio Detection Based On Unsupervised Pretraining Models,","venue":null,"work_id":"58527cfe-715f-4af3-a815-9f62eba76a7a","year":2022},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.450945Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:dfcf70b957a4c9056a920f167da6c5a36bef008ad089a53d0884c8ad44ccb7bc","observation_id":"2855a35f-82c0-468a-8c0f-4196f934212f","resolution":{"observed_at":"2026-08-12T21:03:51.205798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.190841Z","title":"Aasist: Audio anti-spoofing using integrated spectro-temporal graph attention networks,","venue":null,"work_id":"ef29cf2b-edd8-4cba-9d94-a610b52f5e91","year":2022},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.454275Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:0a0e0b05c02a1b441aaf079971eba8ccebc4a3165c703ec5c96aa990c99840f5","observation_id":"34627ef9-0ad9-4600-8c1b-379c65f4cf92","resolution":{"observed_at":"2026-08-12T21:03:51.195020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.179338Z","title":"A robust audio deepfake detection system via multi-view feature,","venue":null,"work_id":"93ab3e3a-fdea-4767-bfb8-4d48c5b72b46","year":2024},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.457640Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:97a656f7b016f26943d6ae75fa9650239d60a0b3c5c22f3b3bb2eab1b1680ca9","observation_id":"bb285b13-9a30-4218-9c41-aa37295ca1dd","resolution":{"observed_at":"2026-08-12T21:03:51.183775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.460964Z","title":"Towards end-to-end synthetic speech detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.460964Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:dc8357aa0ab7cbf51a27b9ee2524973f62d25d3cb7a6ae977460f95541df4f46","observation_id":"e9f1a0d2-f3dc-4c58-b75e-5ebe507e76b2","resolution":{"observed_at":"2026-08-12T21:03:50.460964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.156431Z","title":"Does audio deepfake detection generalize?","venue":null,"work_id":"78102646-dfaf-4d02-94d4-9bd945cffd1c","year":2022},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.464261Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:5e93c5c942f2af80ab7e91a46acdabedfaf448d52ee527247433a9b6d6981fe4","observation_id":"fec4fbec-7fc5-43dd-9bb7-5266f27a305e","resolution":{"observed_at":"2026-08-12T21:03:51.160755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.145483Z","title":"Sedeptts: Enhancing the naturalness via semantic dependency and local convolution for text-to-speech synthesis,","venue":null,"work_id":"dfdc56e1-048f-495e-94ff-9d900cf0c0f9","year":2023},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.467755Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:58a2534d8d722f2e53ee5868780e4b9ba1d0019fedb58961a8c0ef5a85db2f9a","observation_id":"c730db81-5258-42b6-b145-1d26e928cb4f","resolution":{"observed_at":"2026-08-12T21:03:51.149500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.133182Z","title":"Drvc: A frame- work of any-to-any voice conversion with self-supervised learning,","venue":null,"work_id":"419f8db5-3e59-4696-a0f9-aaaf6f23a6f6","year":2022},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.471568Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:40e4c94a8339051a538cebb874a09f803ddcf5388588d8a8ce13aacc9503afc1","observation_id":"a6d52a78-cce8-47db-bc24-91d5e3264148","resolution":{"observed_at":"2026-08-12T21:03:51.137040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.03499","last_updated":"2016-09-19T18:04:35Z","snapshot_observed_at":"2026-08-16T05:39:41.727705Z","submitted_at":"2016-09-12T17:29:40Z","title":"WaveNet: A Generative Model for Raw Audio","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.03499","snapshot_observed_at":"2026-08-12T21:03:50.475224Z","title":"Wavenet: A gener- ative model for raw audio,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.475224Z"},"links":{"cited_paper":"/paper/1609.03499","citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:361302c18cab0a8a7d54eb62eded356b0b65c3a0cb58dc33533b5428cad4dd4e","observation_id":"c605c15d-bb5f-4882-b3bf-987edebc7e80","resolution":{"observed_at":"2026-08-12T21:03:50.475224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.120643Z","title":"Efficient neural audio synthesis,","venue":null,"work_id":"6352101d-2fa2-4ce4-9b41-79c91eb17908","year":2018},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.479062Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:a6349ca40ce6eee9d6bb829b82f4a3d851d9fd1a9661c70f0608c71dfb2ae2c3","observation_id":"5c6374b2-b10b-4a39-b5af-0ac885e673ce","resolution":{"observed_at":"2026-08-12T21:03:51.125490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.108622Z","title":"Guided-tts: A diffusion model for text-to- speech via classifier guidance,","venue":null,"work_id":"cd2f8bb9-a680-43f3-a835-2421dc28c020","year":2022},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.482408Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:3e509079de27a6d46d66416c890f21f26ee5be52c2d23a92e1d40b6ee5fc2be3","observation_id":"877aff25-41f8-4692-8b4e-b5d06b7450bc","resolution":{"observed_at":"2026-08-12T21:03:51.112746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.096168Z","title":"Grad- tts: A diffusion probabilistic model for text-to-speech,","venue":null,"work_id":"cb543a80-d5e9-4b3c-8699-5ec590d46331","year":2021},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.486123Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:d0cacf8f2643acd6e152c6760268a19220e5375d14827013265b15ed60e81cb4","observation_id":"7d8b0804-acdd-4b4b-b658-8c73c0a7fa2f","resolution":{"observed_at":"2026-08-12T21:03:51.100061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.489360Z","title":"Melgan: Generative adversarial networks for conditional waveform synthesis,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.489360Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:bb5a796ad64216f157c26bee473854f6cedb2e2ce4edda2c9298be6fdef9fefd","observation_id":"f0bde8c4-fef3-4144-b34e-2e4bc366190e","resolution":{"observed_at":"2026-08-12T21:03:50.489360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.076853Z","title":"Dspgan: a gan-based universal vocoder for high-fidelity tts by time- frequency domain supervision from dsp,","venue":null,"work_id":"dc3b950f-4652-42bb-b690-b22f9d0532ea","year":2023},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.492571Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:c2262e26e40f151c2b6f95d5bc480065ddcfc58dbd660c1249c9555d4ee9f0d3","observation_id":"3ef7e56b-ef17-4b49-ad37-4dcdae36f867","resolution":{"observed_at":"2026-08-12T21:03:51.081850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.066442Z","title":"Conditional Variational Autoencoder with Adversarial Learning for End-to-End Text-to-Speech,","venue":null,"work_id":"9007f29d-f26f-4ae9-b44c-06ec173f07dc","year":2021},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.495713Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:241282ae83b15417d9bd6c0195015b0531783539e8415e6211eabb25a10aa1c5","observation_id":"dbb75dca-e490-49b1-ae4d-b0733b569a0d","resolution":{"observed_at":"2026-08-12T21:03:51.070170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.056169Z","title":"Hierspeech: Bridging the gap between text and speech by hierarchical variational inference using self-supervised representations for speech synthesis,","venue":null,"work_id":"195ff425-756c-45c9-ab6f-7195eceed8f2","year":2022},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.499139Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:b01523070c2e85fa771d2c3004e00a992329b76752e327471cf3cb1da7b7698b","observation_id":"539ff319-10f4-419f-8349-91413cac04d6","resolution":{"observed_at":"2026-08-12T21:03:51.060076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.044114Z","title":"Unisyn: an end-to-end unified model for text-to-speech and singing voice synthesis,","venue":null,"work_id":"2f89be94-b2bf-42e5-b674-0b081c0e743c","year":2023},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.501911Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:fc588700eaccf5f01c758e0e4b0c2955b31119cb15651236a28c2a3852030840","observation_id":"f6711423-c16d-4e9d-b2a8-b25daa92b9fe","resolution":{"observed_at":"2026-08-12T21:03:51.048360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.033998Z","title":"” hello, it’s me","venue":null,"work_id":"b76ffbc5-ecb8-4c6f-8afe-1966a6e8b3c5","year":2021},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.504759Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:23601e3347efac4f9c74649e5d8ceb31821e2b88060ad8533e9f790754f39791","observation_id":"8f7e01f4-cf42-4151-a032-e722445fb7b1","resolution":{"observed_at":"2026-08-12T21:03:51.037503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.023403Z","title":"Audio replay attack detection with deep learning frameworks","venue":null,"work_id":"634b19cd-1395-4692-8e16-1c63eafa0b56","year":2017},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.508430Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:45ad8d853214f50afd0fdf34f0e81d99f32ac7bb8e9134de9a69626afa75bffb","observation_id":"4f32f520-36e3-4ed5-93b5-13d6fd41ef7d","resolution":{"observed_at":"2026-08-12T21:03:51.027326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.012708Z","title":"Improved rawnet with feature map scaling for text-independent speaker verification using raw waveforms,","venue":null,"work_id":"fc843385-cf4f-48a8-bb68-8d19be196334","year":2020},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.511197Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:5b12926e858617441e368235421ee73d0a88bc525d764e65f82caa60d8b2ab57","observation_id":"059b43dc-4cc9-4475-bc22-495de91d6c6d","resolution":{"observed_at":"2026-08-12T21:03:51.016564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.001827Z","title":"Asvspoof 2021: Towards spoofed and deepfake speech detection in the wild,","venue":null,"work_id":"8f028984-394d-4410-bdd4-894bd82d842a","year":2021},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.514308Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:aa7e981304526079f9475eda5de2e657bd3b04d71876b92aa3c63c3b4a896122","observation_id":"11621a76-62e0-4285-aec2-e2707a5b9b2c","resolution":{"observed_at":"2026-08-12T21:03:51.005572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.990971Z","title":"Stc antispoofing systems for the asvspoof2019 challenge,","venue":null,"work_id":"694f9dcf-af66-473f-afe1-edf86e6550ea","year":2019},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.517624Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:870946e0af63b2a79c4148d96f3f3bcbb2ac5023ff85f141dbefbd31ca2f8bed","observation_id":"89eea66c-b226-4055-9d75-087b47d7221f","resolution":{"observed_at":"2026-08-12T21:03:50.995027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.979208Z","title":"Domain Generalization via Aggregation and Separation for Audio Deepfake Detection,","venue":null,"work_id":"cf05bf14-7f4a-4a9a-b342-ae522c5ea387","year":2024},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.521033Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:c67b5579df5bb08d5883aa63eac1110d2274cca35c488637b77e003b954da78a","observation_id":"3b9e7a7d-82fc-4071-bbd0-7e57ef2dc2fd","resolution":{"observed_at":"2026-08-12T21:03:50.983555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.967981Z","title":"Fully automated end-to-end fake audio detection,","venue":null,"work_id":"ab43f1f6-210f-40fd-aedb-2fb5b424618e","year":2022},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.525118Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:b065b320ca768c04d934c822da4893b3fff662e34be3075d6c7bea243a72deae","observation_id":"000d6ec5-0b0c-4ea5-a0b3-b8a869968d20","resolution":{"observed_at":"2026-08-12T21:03:50.971950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.955316Z","title":"Deepfake audio detection with vision transformer based method,","venue":null,"work_id":"37cb18ac-802a-47d2-b99f-140a8c882d5f","year":2023},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.528720Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:f1040d517efa961fb8763153a95d43f069e523e33f28b30ab95ec5b07cc74c52","observation_id":"b04acc32-b85b-4168-9e60-e02ee0f9b99e","resolution":{"observed_at":"2026-08-12T21:03:50.959988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/1037461","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.725146Z","title":"Audio spectrogram transformer for synthetic speech detection via speech formant analysis,","venue":null,"work_id":"41386859-481e-4fd0-a8f0-7c20456b9d3a","year":2023},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.532078Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:5f4bce1dcc842dd3b05551dc8e08fa2e7f00b240267eb7ab3c301745299c446c","observation_id":"538aa9f7-c70e-46c3-9c78-c4c12eee19e3","resolution":{"observed_at":"2026-08-12T21:03:50.735106Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.943208Z","title":"Audio transformer for synthetic speech detection via multi-formant analysis,","venue":null,"work_id":"61902730-8fb2-43e9-a787-49e56bc0668c","year":2024},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.536006Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:622631297f010c415d7c05659d37918a9476c9ed0596586a82549967cedce2e8","observation_id":"daebac64-bb1e-488b-b90d-d872590f7ade","resolution":{"observed_at":"2026-08-12T21:03:50.947979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15854","last_updated":"2024-04-24T13:10:35Z","snapshot_observed_at":"2026-08-19T20:00:44.430929Z","submitted_at":"2024-04-24T13:10:35Z","title":"CLAD: Robust Audio Deepfake Detection Against Manipulation Attacks with Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15854","snapshot_observed_at":"2026-08-12T21:03:50.539535Z","title":"Clad: Robust audio deepfake detection against manipulation attacks with contrastive learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.539535Z"},"links":{"cited_paper":"/paper/2404.15854","citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:98ce1dc5a502ee3e749ffc33ac0021dc1a3f3fa54091a1f2613b1a33229b288f","observation_id":"87e51d2a-19b3-4bfd-a435-cc249074bfe6","resolution":{"observed_at":"2026-08-12T21:03:50.539535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.930473Z","title":"Towards attention-based contrastive learning for audio spoof detection,","venue":null,"work_id":"059f6456-59e4-4837-85a2-cb9b94a9c7d7","year":2023},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.543619Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:552bff6138ae11e9c9884fbd55428c0314d24b7b0392bc056acf7e5130e4e1f9","observation_id":"4018a5d5-aa32-4b34-a67a-0bdf73e356fd","resolution":{"observed_at":"2026-08-12T21:03:50.934632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.547154Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.547154Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:e1fe776257b1913737becd1966bd1760265d2e321373b15f071904960568a5e9","observation_id":"40d5e325-2705-4440-a6a8-5b24fce36ad6","resolution":{"observed_at":"2026-08-12T21:03:50.547154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.912109Z","title":"How does batch normalization help optimization?","venue":null,"work_id":"19669b64-38a7-4efe-b95d-f9b18b2410e8","year":2018},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.550648Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:62d56cd98839807295c676d12b3b71ee9dee140491fad1a3cb36c518d61f19cb","observation_id":"c0ec93cc-7c56-40ab-ba2e-2d413d495fa8","resolution":{"observed_at":"2026-08-12T21:03:50.915811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.901594Z","title":"Do You Really Mean That? Content Driven Audio-Visual Deepfake Dataset and Multimodal Method for Temporal Forgery Localization,","venue":null,"work_id":"213455cd-26b6-482b-a83c-393330acf430","year":2022},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.554355Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:8dcf1e43fe8c061077831b1d879205e44c9f0ff4d9be0944f6ecbc9fb900a335","observation_id":"f69dd6e7-bceb-45cc-ab44-910e29567ec0","resolution":{"observed_at":"2026-08-12T21:03:50.905595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.557953Z","title":"Focal loss for dense object detection,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.557953Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:88ae13646cd7896743768d3170afb56585e8056992c7f6d5e5ba34dc4bc54bee","observation_id":"1536f258-f88c-422b-a485-f31d1bd884f0","resolution":{"observed_at":"2026-08-12T21:03:50.557953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.885196Z","title":"Transferring Audio Deepfake Detection Capability across Languages,","venue":null,"work_id":"76cb52af-f3e1-49aa-b179-ccb392506f21","year":2023},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.561677Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:4b06e780465592662a85ec2705086c3396ee0bcde485866a0cfba3b2d609e441","observation_id":"1ecdfb60-8d23-4ae0-84eb-036d7ee22b78","resolution":{"observed_at":"2026-08-12T21:03:50.889044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.873847Z","title":"Parallel Wavegan: A Fast Waveform Generation Model Based on Generative Adversarial Networks with Multi-Resolution Spectrogram,","venue":null,"work_id":"0362cf4d-0e27-4089-83c6-7c4c6764142b","year":2020},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.565276Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:3825b8deabfa8aa0af2f06a797680f1e8c9fd2560f41d9f87a00486db1f20b6f","observation_id":"db382c65-5051-4ae2-ae4f-7d76bc31b311","resolution":{"observed_at":"2026-08-12T21:03:50.877856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.569452Z","title":"Hifi-gan: Generative adversarial networks for efficient and high fidelity speech synthesis,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.569452Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:3cef271c14e15aa339fae387b57ac3bd1e5379dbdebc10849a83e0c0eb8f4e90","observation_id":"3710c738-201f-41e2-89f1-ce19c1a245c8","resolution":{"observed_at":"2026-08-12T21:03:50.569452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.573598Z","title":"The lj speech dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.573598Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:e92541b4bd0f4763ee79f054df8a9d93b5f17811a32177acf69e11bfcf8af94b","observation_id":"b4105ee4-2270-468f-add7-554cb6ea21a0","resolution":{"observed_at":"2026-08-12T21:03:50.573598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.00354","last_updated":"2017-10-28T05:28:01Z","snapshot_observed_at":"2026-08-14T20:19:26.882819Z","submitted_at":"2017-10-28T05:28:01Z","title":"JSUT corpus: free large-scale Japanese speech corpus for end-to-end speech synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.00354","snapshot_observed_at":"2026-08-12T21:03:50.577466Z","title":"JSUT corpus: free large- scale japanese speech corpus for end-to-end speech synthesis,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.577466Z"},"links":{"cited_paper":"/paper/1711.00354","citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:cab5bf2f61c552d4ae3886a5827c8d9e846861c5c3d14c4db7a823cdf3496a59","observation_id":"010e184a-b160-43cd-9268-97607cd3389b","resolution":{"observed_at":"2026-08-12T21:03:50.577466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.849937Z","title":"Conformer: Convolution- augmented Transformer for Speech Recognition,","venue":null,"work_id":"5d8e8833-d53e-4bfd-abe8-24b05fd5d8e9","year":2020},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.581155Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:7e972669621b7be0dcb9a58cc97d52d30456532646620fd8c57de304e52beb41","observation_id":"1bd94059-e8f2-4a82-8a32-9aaf21ecda34","resolution":{"observed_at":"2026-08-12T21:03:50.853819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.838373Z","title":"Libritts: A corpus derived from librispeech for text-to-speech,","venue":null,"work_id":"88ca52d8-21f7-4a1f-a7f8-60fa42a5372b","year":2019},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.584565Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:d0e479a4e03658cf62af584b2dfc5c0286f178ccfc35e81ca417a2ddb1ce0fc7","observation_id":"75385680-2562-4535-a18b-495763690df2","resolution":{"observed_at":"2026-08-12T21:03:50.841895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.587445Z","title":"End-to-end spectro-temporal graph attention networks for speaker ver- ification anti-spoofing and speech deepfake detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.587445Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:18260c2081b4d2ab8d97592e21ff5261a69a6a0fb4546a649de0bfc0834a0ca0","observation_id":"80007aa0-991e-4878-8652-46158991b821","resolution":{"observed_at":"2026-08-12T21:03:50.587445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.590424Z","title":"wav2vec 2.0: A frame- work for self-supervised learning of speech representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.590424Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:57453017702c9631a260c32a69bd3d3830c9a67fb81e291715ce039f74676231","observation_id":"19753f59-73a5-47be-9155-d0eb26188e62","resolution":{"observed_at":"2026-08-12T21:03:50.590424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.811988Z","title":"WavLM: Large-Scale Self-Supervised Pre- Training for Full Stack Speech Processing,","venue":null,"work_id":"2954a892-be11-4f40-8a8f-464cd0d8a777","year":2022},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.593722Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:47b31e2115b4cdf3c85bd195282a71de969e2ccd7f44f9fcde6805b51fad0127","observation_id":"7964a61d-0d1f-42df-ba87-5741f83702e5","resolution":{"observed_at":"2026-08-12T21:03:50.816007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.801279Z","title":"Wav2CLIP: Learning Robust Audio Representations from Clip,","venue":null,"work_id":"218201c9-5333-402b-9c6a-93024940a52c","year":2022},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.597387Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:b581db07037df5e41cb3a1d9b04122b6a9b3f5953a6af726dcb9cd2f98b08adb","observation_id":"d9fa4ad3-51e8-4cd6-8287-c0e4eaefdfb3","resolution":{"observed_at":"2026-08-12T21:03:50.805081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.789573Z","title":"Audioclip: Extending Clip to Image, Text and Audio,","venue":null,"work_id":"fdf99da0-f3de-4ef8-8e99-17a1f2487c5c","year":2022},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.600871Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:a74d6bf5f522e8a3124cb637165ad5f10b8a9580e944fb0c6ede5cf040bbb0a0","observation_id":"34979645-32d9-4f95-a81d-6c342e6e74ea","resolution":{"observed_at":"2026-08-12T21:03:50.794013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.778853Z","title":"ESResNe(X)t-fbsp: Learning Robust Time-Frequency Transformation of Audio,","venue":null,"work_id":"cf57c08c-e4a1-4abe-86ed-fc11ecd6a0fa","year":2021},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.604498Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:903aa8e591bee0d145b8531f5584aa4d1a3e900b49aa76fe6ec19aead9946800","observation_id":"79ebbbf1-12b5-4bc1-8c13-3fb05833543c","resolution":{"observed_at":"2026-08-12T21:03:50.782764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.767193Z","title":"Gradient centralization: A new optimization technique for deep neural networks,","venue":null,"work_id":"356539b8-2ac5-4c96-b53a-b94b214729f0","year":2020},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.608862Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:acb06432b8746fda14a32f8a77901f4c705e820a09306e9cfafc61f99c53cbb4","observation_id":"84f2265d-9fb6-4361-a936-c78e38d90854","resolution":{"observed_at":"2026-08-12T21:03:50.771551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.613089Z","title":"Visualizing data using t-SNE","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.613089Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:69eb7405da93d648028c86057aa80d591617946f26acc72485fe83c9def202d2","observation_id":"0a26ebd8-7da7-4f63-86dd-ccbbaef3b541","resolution":{"observed_at":"2026-08-12T21:03:50.613089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:50.616649Z","title":"Grad-cam: Visual explanations from deep networks via gradient-based localization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.616649Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:c8aa70280af4be8d4f6d34e7c96fbeb62c16d8e8c3541fa1e32ffde266ce5e5f","observation_id":"315c7e29-26e8-4ed9-87d3-528985034b0a","resolution":{"observed_at":"2026-08-12T21:03:50.616649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:03:51.315933Z","title":"Available: https://www.vice.com/en/article/pkyqvb/ deepfake-audio-impersonating-ceo-fraud-attempt","venue":null,"work_id":"1f4a0d70-9342-44df-87a7-add31112e2b7","year":null},"citing_paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-12T21:03:50.411459Z"},"links":{"citing_paper":"/paper/2411.09167"},"observation_digest":"sha256:84c7a7aeb91495eb20f15b8e1a586c0c9bb9b4365358ed5fc89aa5022699fc8e","observation_id":"e6a772e7-4641-421c-8504-51d2aae22ed4","resolution":{"observed_at":"2026-08-12T21:03:51.319342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.09167","last_updated":"2024-11-14T03:57:21Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-15T17:07:01.189093Z","submitted_at":"2024-11-14T03:57:21Z","title":"Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":1,"verified_fuzzy":46},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2411.09167."}