{"as_of":"2026-08-07T16:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c3a9c459121ee3566f8ad2e95ea70a103fea01ccaf1885c67fd9e68a7f0c3abd","coverage":[{"denominator":73,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":73,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:56:07.006881Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:55:59.944344Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T07:47:44.705491Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.04143","snapshot_observed_at":"2026-08-06T00:55:59.944344Z","title":"The National Security Agency (NSA), Federal Bureau of Investigation (FBI), and Department of Homeland Security (DHS) recently released a joint report 1","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:55:59.944344Z"},"links":{"cited_paper":"/paper/2508.04143","citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:bd1fb93f48b65d3a89b51ad3817382150ae0c4cd4789d9e08a476d5543823e2b","observation_id":"eee9ee7d-06e4-4f97-86d4-49a2868462e7","resolution":{"observed_at":"2026-08-06T00:55:59.944344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.04143","snapshot_observed_at":"2026-08-05T21:11:15.142989Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.09294","last_updated":"2025-08-12T19:15:13Z","snapshot_observed_at":"2026-08-07T15:34:11.809335Z","submitted_at":"2025-08-12T19:15:13Z","title":"Fake-Mamba: Real-Time Speech Deepfake Detection Using Bidirectional Mamba as Self-Attention's Alternative","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-05T21:11:15.142989Z"},"links":{"cited_paper":"/paper/2508.04143","citing_paper":"/paper/2508.09294"},"observation_digest":"sha256:12291c4bf7d839d505c0fbbf48aaefc0eb2776f21c81dfd741cb4c0afb6d5f39","observation_id":"052f1f24-f58c-4abf-b8e5-6a02b596c464","resolution":{"observed_at":"2026-08-05T21:11:15.142989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"cited_work":{"arxiv_id":"2508.04143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.04143","snapshot_observed_at":"2026-07-03T07:47:44.705491Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark,","venue":null,"work_id":"75e082b6-1db7-46cb-a090-574af4223f17","year":2025},"citing_paper":{"arxiv_id":"2606.10223","last_updated":"2026-06-08T22:22:48Z","snapshot_observed_at":"2026-07-06T23:49:27.565372Z","submitted_at":"2026-06-08T22:22:48Z","title":"Dual-Branch Gated Fusion for Open-Set Audio Deepfake Source Tracing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T14:45:45.359616Z"},"links":{"cited_paper":"/paper/2508.04143","citing_paper":"/paper/2606.10223"},"observation_digest":"sha256:2ca75b7e7ff792e169cdde4247c0bcf85c41b097d1123be1309fa567afe3e13c","observation_id":"a86b9ca3-8224-4e06-8a3c-cca52731c027","resolution":{"observed_at":"2026-07-03T03:47:35.584341Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"cited_work":{"arxiv_id":"2508.04143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.04143","snapshot_observed_at":"2026-07-03T07:47:44.705491Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark,","venue":null,"work_id":"75e082b6-1db7-46cb-a090-574af4223f17","year":2025},"citing_paper":{"arxiv_id":"2606.10758","last_updated":"2026-06-09T12:10:29Z","snapshot_observed_at":"2026-07-06T23:49:56.404171Z","submitted_at":"2026-06-09T12:10:29Z","title":"Anchoring the Unknown: Open-Set Model Attribution via Proxy-Anchor Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T11:48:10.283990Z"},"links":{"cited_paper":"/paper/2508.04143","citing_paper":"/paper/2606.10758"},"observation_digest":"sha256:a70b1695b40579ec01be79ee70971dda1af8fc66969db29cb20bf08d1238826f","observation_id":"9fe54787-5129-4fdd-8930-a1602660c7b2","resolution":{"observed_at":"2026-07-03T07:47:44.706974Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.04143/citation-record","integrity":"/paper/2508.04143/integrity","json":"/paper/2508.04143/citation-record.json","paper":"/paper/2508.04143"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.04143","snapshot_observed_at":"2026-08-06T00:55:59.944344Z","title":"The National Security Agency (NSA), Federal Bureau of Investigation (FBI), and Department of Homeland Security (DHS) recently released a joint report 1","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:55:59.944344Z"},"links":{"cited_paper":"/paper/2508.04143","citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:bd1fb93f48b65d3a89b51ad3817382150ae0c4cd4789d9e08a476d5543823e2b","observation_id":"eee9ee7d-06e4-4f97-86d4-49a2868462e7","resolution":{"observed_at":"2026-08-06T00:55:59.944344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:18.160785Z","title":null,"venue":null,"work_id":"0bb57d22-9a92-4828-b421-f3acacacb86a","year":null},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.000196Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:66d10613a57beacae39fdc1105c00b6016768dd6bfd495bdc6a02d384120e297","observation_id":"56349248-f892-4998-b83d-e720165950c0","resolution":{"observed_at":"2026-08-06T00:56:18.247231Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:17.991947Z","title":"ST Models This section introduces the models used for ST tasks","venue":null,"work_id":"6e98fe28-d29a-480c-8780-ca980aa5a7a5","year":null},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.090858Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:14b8987091cb652740331cc5af2a5b386b14d32c529dd618d5e343f376f3a67d","observation_id":"83656398-b823-47f4-a5a5-5585f6495218","resolution":{"observed_at":"2026-08-06T00:56:18.066684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9872.6682","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:07.802170Z","title":null,"venue":null,"work_id":"110de29c-181d-42a6-a5f8-5b279781e778","year":null},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.260521Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:ad3eb08575f9f23cd0188186cc0a890ed3f4f571d3a0d6e090068b55e8e03ad9","observation_id":"ce65c883-ef87-4226-9074-6058fd955c4f","resolution":{"observed_at":"2026-08-06T00:56:07.874543Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:17.781713Z","title":"Furthermore, we first explore the effects of unseen languages and speakers in ST tasks","venue":null,"work_id":"c15fb90e-aa0c-49c9-8fa0-c6ab289ff986","year":null},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.359059Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:78ecfa1f914942eb21702998522a7ebe0d9867be4066ba6dc1a1fb3fe56cc75a","observation_id":"bb93b1e8-59f6-47d8-92ee-78fb46080183","resolution":{"observed_at":"2026-08-06T00:56:17.887350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:17.583700Z","title":"V oxpopulitts: a large-scale multilingual tts corpus for zero-shot speech generation,","venue":null,"work_id":"2e472a2b-db77-4532-9a61-0a26a6101801","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.448714Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:253a9f9e35f6084428e32f27adaa017de6cafff32893740da8a1b2a51352e8b6","observation_id":"ae01e7da-84fb-40b2-b708-0e1beaa4450a","resolution":{"observed_at":"2026-08-06T00:56:17.677167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:17.383052Z","title":"Promptvc: Flexible stylistic voice conversion in latent space driven by natural language prompts,","venue":null,"work_id":"cda228db-78cc-46d2-b3de-57d45002b442","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.530052Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:6b4c6626dae0845c912d9cd0150a8ff04f67305019ac94d8c1912f59f9fd038f","observation_id":"967ec552-e756-4390-ae01-ca5544bdb30f","resolution":{"observed_at":"2026-08-06T00:56:17.483399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:17.197068Z","title":"A survey on speech deep- fake detection,","venue":null,"work_id":"a3be786c-3ed9-4bf8-acfd-1d331243d765","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.638649Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:83b9008880122a4ef001076e554b904ada0eaf6af5b8a933e70f98924019ec3c","observation_id":"6e42808d-eb7f-4833-b596-c98a4085bc82","resolution":{"observed_at":"2026-08-06T00:56:17.272994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:17.019531Z","title":"Scams and frauds in the digital age: Ml-based detection and prevention strategies,","venue":null,"work_id":"9de6e586-0a90-418b-92d9-6066e7f6e267","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.706319Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:b32fa19defd7cfcfd3332e70cb3ac09006ebf6e14a2a5c0317c39890ccb097a9","observation_id":"aa6542d7-7241-460d-8fbd-8c936adb741e","resolution":{"observed_at":"2026-08-06T00:56:17.116700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:16.832249Z","title":"Ge-gnn: Gated edge-augmented graph neural network for fraud detection,","venue":null,"work_id":"3efc32c6-09c8-497e-94ff-1bb897165e81","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.780053Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:dcec1ec81ffbdf507e2e7b5b05d25b5ea815e82fc4860beeeef8f6e7d7215a68","observation_id":"a4720805-098c-4e50-b9e4-6359792202e5","resolution":{"observed_at":"2026-08-06T00:56:16.925443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:16.728487Z","title":"Crowd density estimation based on multi-level attention maps,","venue":null,"work_id":"14832863-6605-4871-9cd6-d89acf3f4a10","year":2021},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.859291Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:13a4ac3782c876a6f92d28b5e6aa0189b491067ac476f0f9f36608bc2cabe1a8","observation_id":"1178f371-21f6-44bc-b078-ab8fa6c1de14","resolution":{"observed_at":"2026-08-06T00:56:16.777335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:16.570821Z","title":"Frect: Frequency-augmented convolu- tional transformer for robust time series anomaly detection,","venue":null,"work_id":"96b05497-34af-45b8-bc9e-dcd6696a00b8","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.991963Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:5cb4afd7c9eb411d08a688f858a01d63a4b62b536a15151aebabe148dca8aa83","observation_id":"e8bd0b89-731c-4ef9-8408-f0e95b43a8d9","resolution":{"observed_at":"2026-08-06T00:56:16.666041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:16.400688Z","title":"Decomposition-based multi-scale transformer framework for time series anomaly detection,","venue":null,"work_id":"8af610c9-e9cc-454d-872e-32985e8d6146","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:01.139051Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:3a873961f3655048aed77dc4b87107b65798442fb42fa73d1ab396c8adb5565c","observation_id":"fede622c-f34f-48a6-a5ed-f99a9cc74ec4","resolution":{"observed_at":"2026-08-06T00:56:16.485598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:16.233164Z","title":"Asvspoof 2021: To- wards spoofed and deepfake speech detection in the wild,","venue":null,"work_id":"b98ce89e-aecf-453e-b66f-039d043377a8","year":2021},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:01.240264Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:a426f50644a76b3fab5cea2e80221f0acd6dc0a2aefef5ae14ce0a4f33ce0714","observation_id":"08918162-dce4-4e0c-8dd4-0371f4e6b984","resolution":{"observed_at":"2026-08-06T00:56:16.311024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:16.076070Z","title":"Asvspoof 5: Crowdsourced speech data, deepfakes, and adversarial attacks at scale,","venue":null,"work_id":"f723a459-c916-4194-b203-1882ecb1dea5","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:01.346337Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:6c1cd5fedea65e215b57ec3f54d12c1abfa0ae3e5db0fbe53e96e96d4fcf3ad5","observation_id":"55572476-b84f-475c-9a61-c84e07adfdb7","resolution":{"observed_at":"2026-08-06T00:56:16.130982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:15.943379Z","title":"Add 2022: The first audio deep synthesis detection challenge,","venue":null,"work_id":"0670e0f6-968a-4ee9-a485-9879f92bbc81","year":2022},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:01.464462Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:8618165a5970fa10a561a430acc21bed7f0101f16edfdb1ae858e485e1fb9340","observation_id":"5a73b0e2-d8cb-416b-9937-5f1a2ddb12e1","resolution":{"observed_at":"2026-08-06T00:56:16.015889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:15.748737Z","title":"Add 2023: The second audio deep- fake detection challenge,","venue":null,"work_id":"9916a622-e481-4bde-b6d9-c7e32ad740e2","year":2023},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:01.569769Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:59535dd065845a0f5a11faa6b734007ecf97002c7d05a57ed57290e6cd2b5229","observation_id":"28d06135-1de1-4c0e-b633-afb3ccdcb011","resolution":{"observed_at":"2026-08-06T00:56:15.860576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:15.611804Z","title":"Trident of poseidon: A generalized approach for detecting deepfake voices,","venue":null,"work_id":"6df52836-374a-45e6-8ccf-e3e6de1d6495","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:01.669453Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:bc59abb27427f7ab7dd2255e5e962191954c57932ab9941959f96ab00402a6cf","observation_id":"4101efc8-ef66-43c0-b377-b6cb9d2479c6","resolution":{"observed_at":"2026-08-06T00:56:15.690594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:15.469173Z","title":"Xlsr-mamba: A dual-column bidirec- tional state space model for spoofing attack detection,","venue":null,"work_id":"c5921f14-c049-4ec4-af6c-40e78441b79d","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:01.748111Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:9cff205b5d82f7004c7d618151fcf95be81d9b88999297c76fd2014caffc00e1","observation_id":"64e5bd5a-5e7f-4d1e-b752-dcf9c086976b","resolution":{"observed_at":"2026-08-06T00:56:15.538809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:01.842439Z","title":"Nes2net: A lightweight nested architecture for foundation model driven speech anti-spoofing,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:01.842439Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:49310800600c50cce5894a3f8ea0a22049e44ae931303e03bba01b853cd471ee","observation_id":"58d09424-e207-40c8-8724-545deb5c3d33","resolution":{"observed_at":"2026-08-06T00:56:01.842439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:15.311671Z","title":"Interpretable temporal class activation representation for audio spoofing detection,","venue":null,"work_id":"820ceb43-a4d8-472c-8ce8-57f3b3754c71","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:01.946925Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:f055c29b617de0245da68e6cffa3f1eb9919d42d301291d02a9e95ce031344ac","observation_id":"5254a8b5-7b4b-4fc9-a5b2-68d83211e416","resolution":{"observed_at":"2026-08-06T00:56:15.373056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:15.169464Z","title":"Speech watermarking: An approach for the forensic analysis of digital telephonic recordings,","venue":null,"work_id":"95fadaa4-7825-4fb9-8968-0dc1a0f395a3","year":2018},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:02.065349Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:49484d61d81b5a7d1de0175cca9ca7ebeb3d15aa1c4d7368dab6b4430bd3a82f","observation_id":"1d3052c4-b041-4eef-a583-75c62baf6f0e","resolution":{"observed_at":"2026-08-06T00:56:15.229590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:15.016027Z","title":"Digital image foren- sics via intrinsic fingerprints,","venue":null,"work_id":"6e381057-6b29-4f5f-8505-a2ae596929bd","year":2008},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:02.181715Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:aa5529fe52e083103845b162a7f0ceb33bee588ab3529e9601328cf95ddbdd85","observation_id":"37358d63-a196-433a-9053-1a1f5a7dfb76","resolution":{"observed_at":"2026-08-06T00:56:15.059054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:14.905183Z","title":"Forensic analysis and anonymization of printed documents,","venue":null,"work_id":"5776bd46-5978-420c-9900-e9ff76b69d1b","year":2018},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:02.285470Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:69fe045f32dc299f41502b9046a5de5537249ea6de7ae0ab4b06daca6891bb7b","observation_id":"d2c65c68-0f4e-4f88-9bc4-9d863ff7972c","resolution":{"observed_at":"2026-08-06T00:56:14.953165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:14.799987Z","title":"Transformer for authenticating the source microphone in digital audio forensics,","venue":null,"work_id":"1046860b-66d5-4dbe-92a8-e5c03310aab5","year":2023},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:02.389620Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:e75b5d24a38f56d1cb18024284d05ceccb6b26ac00d164c187df1be0fd1bea40","observation_id":"ad8e7d0d-dc5a-474c-833e-d9175e36b487","resolution":{"observed_at":"2026-08-06T00:56:14.848103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:14.696092Z","title":"Primek-net: Multi- scale spectral learning via group prime-kernel convolutional neu- ral networks for single channel speech enhancement,","venue":null,"work_id":"946cf08b-30d8-40ae-a854-8d8c859104aa","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:02.500121Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:1e705768af0fdd9d427c58608f7cda28ef93687efb73467f6518d71faf4fe5c0","observation_id":"60e8f7cb-4a42-46e7-a5e3-b6ab2276717e","resolution":{"observed_at":"2026-08-06T00:56:14.743805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:14.563247Z","title":"Guidelines on cell phone forensics,","venue":null,"work_id":"5b15c180-d67e-4680-a90a-5d5f89c960fa","year":2007},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:02.610783Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:66e63b72250bf14b83274093baf8241bcd00c2b689cc401b072f1bf5ece1c7b6","observation_id":"3382003a-ff3d-4549-a42a-befa12a45748","resolution":{"observed_at":"2026-08-06T00:56:14.634731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:14.359662Z","title":"Source cell-phone recognition from recorded speech using non-speech segments,","venue":null,"work_id":"9abbefa3-072c-4660-b4ae-74b7915688a5","year":2014},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:02.758730Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:05b45d37f6a5429da7d0ff8985270039dd9070612ac0a29d5b1dd5455230424d","observation_id":"cf32e523-1269-4edd-9360-9b2346fd045c","resolution":{"observed_at":"2026-08-06T00:56:14.467337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:14.217268Z","title":"Forensic analysis of phone call networks,","venue":null,"work_id":"cb73b793-6298-43c1-8763-d9ff1f5ba42b","year":2013},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:02.847033Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:731bea360331c464285517cc1eceeee231565cf95ee712ce95a12b24beb261cb","observation_id":"f404b511-58e9-443c-af46-6a313b632f34","resolution":{"observed_at":"2026-08-06T00:56:14.264129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00946","last_updated":"2025-05-02T01:17:03Z","snapshot_observed_at":"2026-08-07T15:57:12.976106Z","submitted_at":"2025-05-02T01:17:03Z","title":"Addressing Noise and Stochasticity in Fraud Detection for Service Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00946","snapshot_observed_at":"2026-08-06T00:56:02.920597Z","title":"Addressing noise and stochasticity in fraud detection for service networks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:02.920597Z"},"links":{"cited_paper":"/paper/2505.00946","citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:8107b988974b077c1e9bb2f1f257be4c19cccd57db1b6fd4a4fba157c4886ede","observation_id":"eafc6215-46f5-4fe5-b0b4-6c63e0b63291","resolution":{"observed_at":"2026-08-06T00:56:02.920597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:14.041584Z","title":"Source tracing of audio deepfake systems,","venue":null,"work_id":"06e9a31b-4b30-48a4-9240-0c51df728562","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.017005Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:a3012af7ffe27f15f1e1450c0df2c3ccd643bd3d5ca48569cd8bb428fc4fce17","observation_id":"19a7abc9-5459-4a15-9fed-543e378e45b6","resolution":{"observed_at":"2026-08-06T00:56:14.134743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:13.927142Z","title":"Generalized source tracing: Detect- ing novel audio deepfake algorithm with real emphasis and fake dispersion strategy,","venue":null,"work_id":"74b2dfae-844b-4a79-89d7-d0cac785b0be","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.083996Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:15a8080a201c2f9709e31b8ce1ebf0fc66a79960650495cb5de113105de104ba","observation_id":"1e9a8fc7-46b2-415f-b327-a3fbb29e9626","resolution":{"observed_at":"2026-08-06T00:56:13.996714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06514","last_updated":"2025-01-11T11:15:58Z","snapshot_observed_at":"2026-07-06T20:19:40.856839Z","submitted_at":"2025-01-11T11:15:58Z","title":"Neural Codec Source Tracing: Toward Comprehensive Attribution in Open-Set Condition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06514","snapshot_observed_at":"2026-08-06T00:56:03.182937Z","title":"Neural codec source tracing: Toward comprehensive attribution in open-set condition,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.182937Z"},"links":{"cited_paper":"/paper/2501.06514","citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:d452179cdb70959d11490e27b5bb70192e058b1ba2ffff133dbb3d452bbd0c17","observation_id":"a7513c1d-727f-4e63-a225-aab2471085a3","resolution":{"observed_at":"2026-08-06T00:56:03.182937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:13.768487Z","title":"Multilingual speech translation from efficient finetuning of pretrained models,","venue":null,"work_id":"511d69d9-12b0-4d8b-8ca4-886d1e9e5860","year":2021},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.294255Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:acd9a445d613dea9ac12fc6b93145d5a1cf71b282f24fca6e9aad15a338041a2","observation_id":"eac11690-e0f1-44d3-9d81-2f1b7c30b772","resolution":{"observed_at":"2026-08-06T00:56:13.828973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:13.617384Z","title":"Solving the unsolvable: Translating case law in hong kong,","venue":null,"work_id":"d84d5cbf-5426-4b72-9cb4-0b887829a767","year":null},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.397022Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:c939182c98ac8e94925d37eebc0e47239332abd0f64dc908e36782c1559315d6","observation_id":"9fd16104-5ca3-4827-a987-796525d6563c","resolution":{"observed_at":"2026-08-06T00:56:13.674857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:12.429626Z","title":"Multi-scene ro- bust speaker verification system built on improved ecapa-tdnn,","venue":null,"work_id":"8fdcb610-94a4-43bc-afb3-2c5ab19561db","year":2022},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.997788Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:54d6a7a32cedfd82f904791285676fbcb16e5a867bcc834bd57c4217b6fb021d","observation_id":"00e4b416-629c-489c-96ee-92fc0653910f","resolution":{"observed_at":"2026-08-06T00:56:12.498785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00875","last_updated":"2026-06-17T18:13:36Z","snapshot_observed_at":"2026-08-06T21:02:45.038455Z","submitted_at":"2025-07-01T15:39:26Z","title":"TransLaw: A Large-Scale Dataset and Multi-Agent Benchmark Simulating Professional Translation of Hong Kong Case Law","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.00875","snapshot_observed_at":"2026-08-06T00:56:03.545227Z","title":"Translaw: Benchmarking large language models in multi-agent simulation of the collaborative translation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.545227Z"},"links":{"cited_paper":"/paper/2507.00875","citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:8ff333eb523d550d490b1a2b3570592a030394acad8c898ad5598e357fea011e","observation_id":"9786e7e2-96f6-4a15-8928-b21ab0fadf8c","resolution":{"observed_at":"2026-08-06T00:56:03.545227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:13.377818Z","title":"Probing the feasibility of mul- tilingual speaker anonymization,","venue":null,"work_id":"27fead65-a1b6-4bdd-9ef2-29f86500f854","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.658914Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:8de3ab4aaff70f36cb8e802a51a826d68a6472ec69729405256c40fc58054acf","observation_id":"b957727f-eccb-4d3c-944a-f7ea871ec660","resolution":{"observed_at":"2026-08-06T00:56:13.513840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:13.072846Z","title":"Introducing multilingual pho- netic information to speaker embedding for speaker verification,","venue":null,"work_id":"04d02ac9-52d2-4908-846a-8b2bb99c20a9","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.803187Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:0084b98d21e7c9da2549e38559099d5d2a9243a1f1e7b6a256a3be04c4b96a32","observation_id":"2f85fa83-f9a0-4a3e-a484-23b5c9735d62","resolution":{"observed_at":"2026-08-06T00:56:13.228239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:12.834910Z","title":"Research on front-end of asv system based on mel spectrum in noise scenario,","venue":null,"work_id":"e3906918-d87d-4c9b-8716-ec9c60933aa7","year":2022},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.871923Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:dda2334235ed51ef330c6b0b040c897ff9158c0c1fb5d7c1029a410fd03813e3","observation_id":"3d4f59a2-7652-4d25-8c7b-c2b3532fa9db","resolution":{"observed_at":"2026-08-06T00:56:12.891550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:12.600899Z","title":"Research on acoustic feature extractor for automatic speaker verification systerm,","venue":null,"work_id":"696a9ba7-98a1-4ed3-9283-ebf147ede759","year":2022},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.936293Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:35bd04dae12788d83f9b400f194d15575d9b004f228eb07a6c547e94dd60f441","observation_id":"bacc259c-4c30-4196-bce3-05fd809ac478","resolution":{"observed_at":"2026-08-06T00:56:12.687581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:11.531845Z","title":"Madd: A multi-lingual multi-speaker audio deepfake detection dataset,","venue":null,"work_id":"fe92301e-623b-4dc2-870c-e2bf84665460","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.552136Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:fe51acf3d30ec8c26a252169c2d3a29ac015c68934216ca901e781dc72373fcb","observation_id":"1afa8729-0b48-4082-8c8a-738a29503a33","resolution":{"observed_at":"2026-08-06T00:56:11.589663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:12.253666Z","title":"Research on speaker identifica- tion models based on cnn and additive angular margin loss,","venue":null,"work_id":"f1a98574-6ddf-42da-b336-64d0cac94fa9","year":2021},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.061412Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:ca75a5cb8fba9e7ba1dcbbd7f65d29eef1b4cf3db91f97d3fb8ac929816fcfb1","observation_id":"a10be848-2578-4218-9daa-c8c290370de6","resolution":{"observed_at":"2026-08-06T00:56:12.324043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:12.108236Z","title":"Conformer-based speaker recogni- tion model for real-time multi-scenarios,","venue":null,"work_id":"f4b34fe4-d8ea-4100-99b7-3f47948d217a","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.200284Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:ea5e01ae26977ac88289d9a94e2bcaf8d26e4d232fa1833de8bc1756fb06aed0","observation_id":"4f30c6b4-bac2-4f2b-b825-71070d464d6b","resolution":{"observed_at":"2026-08-06T00:56:12.192642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:11.964758Z","title":"Scaling speech technology to 1,000+ languages,","venue":null,"work_id":"2a114e2a-58a7-4994-9b0c-bdd4529829d1","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.281691Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:4e01a0e3967bd6d4094eec5fc04701b554c671570afeb23573a381e09258a0fa","observation_id":"c9d4cee2-0a91-4799-8c36-bb94fd8ac5db","resolution":{"observed_at":"2026-08-06T00:56:12.036975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:11.835438Z","title":"Neural codec language models are zero-shot text to speech synthesizers,","venue":null,"work_id":"68709fe5-e547-4f27-88d2-eb28e4227578","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.380251Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:01594b298d218789ea475e78d0197fefb36ee84874913e24d009f54f8ca3a08e","observation_id":"5fc77ba6-dca7-4e28-a1eb-df92620a04e3","resolution":{"observed_at":"2026-08-06T00:56:11.880182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:11.641477Z","title":"Polyglotfake: A novel multilingual and multimodal deepfake dataset,","venue":null,"work_id":"5fae8996-57dc-4ec1-b5e7-57fa43cddb4f","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.463808Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:6c2c90d42a68135eb7ba82dcf7b10ee6facec198ddb63b4235f0667dc533ca6b","observation_id":"e9ff347f-d20a-4f31-a051-0f75cc31cff0","resolution":{"observed_at":"2026-08-06T00:56:11.736451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1510.08484","last_updated":"2015-10-28T20:59:04Z","snapshot_observed_at":"2026-07-06T04:34:36.474437Z","submitted_at":"2015-10-28T20:59:04Z","title":"MUSAN: A Music, Speech, and Noise Corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.08484","snapshot_observed_at":"2026-08-06T00:56:05.111511Z","title":"Musan: A music, speech, and noise corpus,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.111511Z"},"links":{"cited_paper":"/paper/1510.08484","citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:9fdf3b5ea7da05b9e4af892ae70e1883ca7bc2ca9ce9e041b7e5d3ccc3d3349e","observation_id":"fd3dd8cc-d7c3-4a43-9224-d7184b963d71","resolution":{"observed_at":"2026-08-06T00:56:05.111511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:11.436915Z","title":"Mlaad: The multi- language audio anti-spoofing dataset,","venue":null,"work_id":"3f857aeb-6bd8-4ff6-879d-c66521a72c32","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.671909Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:d9664d70de6c61838921e200d0b6342e1efd661f71032893ff3e1be268653d28","observation_id":"e6ee83dc-8e2b-40d1-a4d6-48b14d2fdcb8","resolution":{"observed_at":"2026-08-06T00:56:11.478947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:11.245837Z","title":"Heterogeneity over homogeneity: Investigating multilingual speech pre-trained models for detecting audio deepfake,","venue":null,"work_id":"8f7812a8-03fd-4b53-bb7d-2c501df50c05","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.767943Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:aa5ecb133ad52d52b0a03fea923522260160991dda5abdee0c36961034b0bed4","observation_id":"3d368de1-c577-4638-9f2e-6ae12db016d9","resolution":{"observed_at":"2026-08-06T00:56:11.344934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:11.061830Z","title":"Transferring audio deepfake detection capability across lan- guages,","venue":null,"work_id":"f7eaf861-ea80-423e-b9a7-73423ed123a6","year":2023},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.859111Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:72ebf0f4c9dfbbcf930952556893c080ddefe864b042eb9910d6c86106ff9cd0","observation_id":"5b8d4906-80f4-4037-adf5-6ad719b7226b","resolution":{"observed_at":"2026-08-06T00:56:11.143453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:10.919845Z","title":"Towards quantifying and reducing language mismatch ef- fects in cross-lingual speech anti-spoofing,","venue":null,"work_id":"3704c490-8a8a-4364-a542-1e47b44347ed","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.951496Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:a570666fdd5013a3682df37ee2f4b79d36bde07957f4d250dc2fbfd16dfa71ac","observation_id":"09d36118-c90a-4228-a268-b0a937053c4e","resolution":{"observed_at":"2026-08-06T00:56:11.001860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17924","last_updated":"2025-08-06T12:54:16Z","snapshot_observed_at":"2026-07-06T20:12:22.686355Z","submitted_at":"2024-12-23T19:32:53Z","title":"Are audio DeepFake detection models polyglots?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17924","snapshot_observed_at":"2026-08-06T00:56:05.043440Z","title":"Are audio deepfake detection models polyglots?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.043440Z"},"links":{"cited_paper":"/paper/2412.17924","citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:56f3922cf8e79dd46a0effebf330cac9d7a66cafb92c761c71765e4c8ee1eabf","observation_id":"90ae49ac-2900-4611-8d86-d85c891c226b","resolution":{"observed_at":"2026-08-06T00:56:05.043440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:10.041043Z","title":"Aasist: Audio anti-spoofing us- ing integrated spectro-temporal graph attention networks,","venue":null,"work_id":"de18ae24-d98b-4a98-83f5-bef9f6a53ea2","year":2022},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.715887Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:832e40ab9c3ecec811050ab5fd3823bc97aeb45e671edb07a6cf8c8e00a1c720","observation_id":"516e640b-a9a9-41e6-8f5e-9c7a0e120324","resolution":{"observed_at":"2026-08-06T00:56:10.111373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:10.745870Z","title":"Shortcut learning in deep neural networks,","venue":null,"work_id":"c0564ae0-dad2-44e0-882a-87da77e9f6c4","year":2020},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.252454Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:a644bdfa7db244937d465d61394570e993574f805cc7f9113a8488d13b64d664","observation_id":"76d3647a-110d-4bea-ba6e-371533564d59","resolution":{"observed_at":"2026-08-06T00:56:10.817527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:10.574168Z","title":"Ecapa2: A hybrid neural net- work architecture and training strategy for robust speaker embed- dings,","venue":null,"work_id":"84000af9-7edb-4174-9474-ec97505f824f","year":2023},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.365763Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:861af8be90e41eec02c87f6b50811abfeb45b94eabb8e8f094437dfb5f58df69","observation_id":"9873d17d-896c-46d2-b3eb-40784435531d","resolution":{"observed_at":"2026-08-06T00:56:10.669302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1023/a:1007612920971","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:07.120047Z","title":"Concept decompositions for large sparse text data using clustering,","venue":null,"work_id":"2a3699ba-0c47-4d74-ad33-84c6e4c4d7d9","year":2001},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.425866Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:e947acccf64248e07ce7d7eee4bbb8628b35943aac9614a626823a3e6867c608","observation_id":"a579830c-3627-4dc2-8d1d-28b2c76003c6","resolution":{"observed_at":"2026-08-06T00:56:07.194218Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:10.376838Z","title":"Review on determining number of cluster in k-means clustering,","venue":null,"work_id":"0ac76abf-19ea-4314-b714-28652a0af2a1","year":2013},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.492686Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:19752378e288651a1540253b40c728905d9c0c26f3b04d6e1afb4cf4de6438a2","observation_id":"dbf9e1c0-c1eb-4bc4-9ddc-265a812e853d","resolution":{"observed_at":"2026-08-06T00:56:10.465100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:10.193727Z","title":"A comparison of features for synthetic speech detection,","venue":null,"work_id":"4d9f1cdc-3d3f-434f-9947-e84cded2e28a","year":2015},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.594331Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:1e824ad84c0aed82ee4b15d81b863dad45a6d4e0475fb95c3360dde4ecb9e03f","observation_id":"e91df8d7-0cd8-477b-9fe0-cf8a1eddcc8a","resolution":{"observed_at":"2026-08-06T00:56:10.266093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:09.101455Z","title":"Common V oice: A massively-multilingual speech corpus,","venue":null,"work_id":"39d68bbc-b3c9-4756-933f-8245b9f38862","year":2020},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:06.182071Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:199f1b80e647bbcd6942df243f4bb6c85e023c539a56e83ab21bd32b1389b02e","observation_id":"c61d3539-4c7a-4245-a015-6232547136b2","resolution":{"observed_at":"2026-08-06T00:56:09.218746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:05.806000Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.806000Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:907b48072896b72a8f19a2e8114f32cd38c0fa89abba3e293189ad42e9233167","observation_id":"40b9ace0-5bb2-4ccc-a10f-8661647d8d2f","resolution":{"observed_at":"2026-08-06T00:56:05.806000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:09.859582Z","title":"ECAPA- TDNN: Emphasized channel attention, propagation and aggrega- tion in TDNN based speaker verification,","venue":null,"work_id":"a952d350-8b33-4b98-ab5b-819214678800","year":2020},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.874370Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:620c0fb0f342b80b40cb1f2d9d54eaa40ee46e2cba95658e65b1eca555be31e6","observation_id":"a2423df7-60c4-4143-a36f-a1376ea346ed","resolution":{"observed_at":"2026-08-06T00:56:09.939039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:09.682304Z","title":"Unsu- pervised cross-lingual representation learning for speech recogni- tion,","venue":null,"work_id":"70468437-2446-4d89-8b92-f9dd4425bb15","year":2021},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.941412Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:f7ab85640b6b27171b6586e674abbacd2139bde974065aa65070533eddfc1cbb","observation_id":"edb00b6a-3a84-4463-a96c-58ae836c9342","resolution":{"observed_at":"2026-08-06T00:56:09.759102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:09.452498Z","title":"V oxpopuli: A large-scale multilingual speech corpus for representation learning, semi- supervised learning and interpretation,","venue":null,"work_id":"c19e8cfc-d849-4fd4-831f-1b0aa6ca05cb","year":2021},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:06.008734Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:f329d943d3d40536c608f979905c6bd1e52e3936d007499a9bc10dc9c87db5a4","observation_id":"8651a924-bad0-4147-ae96-f32a9f898d27","resolution":{"observed_at":"2026-08-06T00:56:09.570969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:09.298007Z","title":"MLS: A large-scale multilin- gual dataset for speech research,","venue":null,"work_id":"fb5b683e-e9d3-47f9-b66c-8ddd1b8a4368","year":2020},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:06.092376Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:c07afd86bc3af795281419f694e44a1089717f2fa0aac4d04161cec9638042c3","observation_id":"d345779e-6c42-4f7a-99f8-9353489a22fc","resolution":{"observed_at":"2026-08-06T00:56:09.385741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.09412","last_updated":"2018-04-27T21:39:25Z","snapshot_observed_at":"2026-07-06T06:06:04.571585Z","submitted_at":"2017-10-25T18:30:49Z","title":"mixup: Beyond Empirical Risk Minimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.09412","snapshot_observed_at":"2026-08-06T00:56:06.907770Z","title":"mixup: Beyond empirical risk minimization,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:06.907770Z"},"links":{"cited_paper":"/paper/1710.09412","citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:5f8b483582748c5e6c2f03f9c33f505b660532f661c92e67560afe0bc0ff2dd8","observation_id":"e236270a-e5d2-4ea3-a3fe-6584f760c568","resolution":{"observed_at":"2026-08-06T00:56:06.907770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:08.860702Z","title":"V oxlingua107: A dataset for spoken lan- guage recognition,","venue":null,"work_id":"21679d91-d9ac-4385-a005-fa2c2a5e460f","year":2021},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:06.300770Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:ece5fb0ebca40cb2e0c69a10c49efd64ede019d9f3ea139a24027d9b07553c0a","observation_id":"849cdd31-960d-46ec-ae65-33a18129af6c","resolution":{"observed_at":"2026-08-06T00:56:08.986663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:08.632617Z","title":"Speech recog- nition and keyword spotting for low-resource languages: Babel project research at cued,","venue":null,"work_id":"c6cb5d79-a068-4cef-97ae-58e512830d48","year":2014},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:06.417047Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:92b19b3ead5ea93bf3db5bac97aa085222778e74068b5d00e2e1dfa54e2996bf","observation_id":"653873a3-b03b-4db6-a48d-5b608aae17f3","resolution":{"observed_at":"2026-08-06T00:56:08.731722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:08.458782Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech represen- tations,","venue":null,"work_id":"324ced74-b536-41e9-ac99-199ea2642863","year":2020},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:06.547371Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:636adb08bebdac02ab92044b93bfd837114950e8073203e33b5406b65b348883","observation_id":"ebc521c7-cc74-475a-bca3-f230ded0ba12","resolution":{"observed_at":"2026-08-06T00:56:08.544693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:08.266170Z","title":"Lib- rispeech: An asr corpus based on public domain audio books,","venue":null,"work_id":"2b8755ac-7cf7-4b5f-be59-a61eccc72109","year":2015},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:06.654116Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:58b00b715b863d04650c912e551d57f66ad1baaa7e8593d428011401824933a9","observation_id":"2fbbd414-1fdf-4d6a-9016-347bed2e2c9e","resolution":{"observed_at":"2026-08-06T00:56:08.355635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:08.097061Z","title":"Towards generalisable and calibrated audio deepfake detection with self-supervised represen- tations,","venue":null,"work_id":"3f315deb-8ebe-4b50-a53f-0ff13799be24","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:06.799036Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:f20d35a527a4be79abf7dff0dbe1532b4162c614be108d81cbfe85e7d7f3e3c2","observation_id":"52fd4e74-5343-4c5d-9f01-c63832aa2062","resolution":{"observed_at":"2026-08-06T00:56:08.176258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:07.944310Z","title":"Unlocking the full potential of separa- ble convolutions on tensor cores,","venue":null,"work_id":"251f6db6-7493-4374-bdd1-da11217f350e","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:07.006881Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:33a3aac2c56d4ca1ee232c06906d6d37ff584c3f11cfba48b517e82e46fbe15b","observation_id":"3b6a9171-82e2-4b3f-9907-dac1fada41bf","resolution":{"observed_at":"2026-08-06T00:56:08.027260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.09444","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:07.408438Z","title":"Available: https://arxiv.org/abs/2501.09444","venue":null,"work_id":"7b1fedea-96b9-4f6c-b572-36209c264df9","year":null},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.460432Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:7e07f5ae295d6f70fe633966922bb69fbdc3b78c8cf916c6f75a29f0e7c906fe","observation_id":"5966257d-e303-4ecc-a9bd-047f8192b98a","resolution":{"observed_at":"2026-08-06T00:56:07.497074Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-06T12:06:24.240254Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark"},"reference_resolution":{"displayed":73,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":3,"verified_fuzzy":60},"total_outbound_references":73},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 73 of 73 outbound references and 4 inbound Pith citation observations for arXiv:2508.04143."}