{"as_of":"2026-08-12T03:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2139eabe27aa11bd555dcd58a052df28ced024892779678248c49b6e55adcd1d","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:25:17.304984Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.08691/citation-record","integrity":"/paper/2501.08691/integrity","json":"/paper/2501.08691/citation-record.json","paper":"/paper/2501.08691"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.921990Z","title":"An overview of automatic speaker verification system","venue":null,"work_id":"5451eaf8-ef4c-47bd-a1d0-e9178327521b","year":2017},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.128638Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:48631234b3a12876437b41ad3186c26d32c63be50be847fc06ab32ebd213b38d","observation_id":"f7aa6112-747a-4826-ad78-023bbe2bb730","resolution":{"observed_at":"2026-08-10T20:25:17.926666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.133978Z","title":"V oxceleb: Large-scale speaker verification in the wild.Computer Speech & Language, 60:101027, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.133978Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:da835aee87c6142b4985869010fabb8b1e79f1a8e05f1cc09b85b66273bd72ae","observation_id":"3ce7e09f-8dae-4780-8ac8-90a4fab1c0aa","resolution":{"observed_at":"2026-08-10T20:25:17.133978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.898685Z","title":"Aishell-1: An open-source mandarin speech corpus and a speech recognition baseline","venue":null,"work_id":"c057e67e-9fd2-4515-aa1f-f3fb2e3abb53","year":2017},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.138678Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:c8f73c33caee7bce0a952b66c2e6394dac9712003c4860a79107dc7ca5a16ace","observation_id":"91858d7a-acc8-464f-828c-7c8b603669a6","resolution":{"observed_at":"2026-08-10T20:25:17.903535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1808.10583","last_updated":"2018-09-13T02:45:27Z","snapshot_observed_at":"2026-08-10T01:59:34.520388Z","submitted_at":"2018-08-31T03:11:08Z","title":"AISHELL-2: Transforming Mandarin ASR Research Into Industrial Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.10583","snapshot_observed_at":"2026-08-10T20:25:17.143279Z","title":"Aishell-2: Trans- forming mandarin asr research into industrial scale","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.143279Z"},"links":{"cited_paper":"/paper/1808.10583","citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:6cab1743870b738211c07846a721f90f514ba3e18192788af593885d089cd5e1","observation_id":"2b939188-a463-43aa-abd9-ba8514b217c2","resolution":{"observed_at":"2026-08-10T20:25:17.143279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.884660Z","title":"Intel far-field speaker recognition system for voices challenge 2019","venue":null,"work_id":"eb1c8e3c-6a69-44c0-b68b-035ae1797236","year":2019},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.148860Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:a612c53b9c74ecde5ef51215adfb39edc6fa5c77e8c1aeb9ad5de871869de786","observation_id":"d251519e-2cbe-4be3-b7d8-8f6db6a8560a","resolution":{"observed_at":"2026-08-10T20:25:17.889503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.869780Z","title":"Far-field speaker verification challenge (ffsvc) 2022: Challenge evaluation plan, 2022","venue":null,"work_id":"43055e27-510f-4709-9cff-28f1fe92717f","year":2022},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.153207Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:70ef91f067137017112389bbca3b9c8c698792b1bb01d2ef735c30ef59539878","observation_id":"ef53dd24-62a0-4c33-b27c-9ab4fe5e07fb","resolution":{"observed_at":"2026-08-10T20:25:17.875067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.855849Z","title":"The voices from a distance challenge 2019","venue":null,"work_id":"bf093cf2-4abd-4c47-b1a4-c88876db6209","year":2019},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.158310Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:d2cad23024d73b5506d57ec628720d84ac11195cbe81e29f312cbc3fed0abc79","observation_id":"65a75c83-b0b7-4121-9071-c46918c9669f","resolution":{"observed_at":"2026-08-10T20:25:17.860376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.842066Z","title":"Hi-mia: A far-field text-dependent speaker verification database and the baselines","venue":null,"work_id":"2633b942-ace8-4950-a97c-0fb4abb14844","year":2020},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.162598Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:b75583ab1ae28acfd9418308c05b063d165f67282a3bcf186f7ad0add67c25bb","observation_id":"55a16a56-8a2c-4dfd-8eee-2d6e1f004bc4","resolution":{"observed_at":"2026-08-10T20:25:17.846639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.827530Z","title":"Multisv: Dataset for far-field multi-channel speaker verifi- cation","venue":null,"work_id":"793a2b39-f8f9-4091-a01d-8432cd1c03f0","year":2022},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.167063Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:3d660537751676fb588139fb07a18c1575b355c95faca3540169225b4dd2ea2c","observation_id":"942e3772-ed0d-49f2-b42c-e529069f8e17","resolution":{"observed_at":"2026-08-10T20:25:17.832387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.03521","last_updated":"2020-08-08T13:32:48Z","snapshot_observed_at":"2026-07-06T09:45:35.459864Z","submitted_at":"2020-08-08T13:32:48Z","title":"NPU Speaker Verification System for INTERSPEECH 2020 Far-Field Speaker Verification Challenge","version":1},"cited_work":{"arxiv_id":"2008.03521","doi":null,"metadata_source":"pith","pith_arxiv_id":"2008.03521","snapshot_observed_at":"2026-08-10T20:25:17.454811Z","title":"NPU Speaker Verification System for INTERSPEECH 2020 Far-Field Speaker Verification Challenge","venue":"eess.AS","work_id":"ad603725-e0e7-4491-b14d-cb3f71d372ad","year":2020},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.171400Z"},"links":{"cited_paper":"/paper/2008.03521","citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:a97c298dcdc8986626eafd1664066fa24b3df1806b1b8ca577af105504060438","observation_id":"ca6f9c05-3012-4e26-830e-0ab0d0186296","resolution":{"observed_at":"2026-08-10T20:25:17.459787Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.08046","last_updated":"2020-05-16T17:13:28Z","snapshot_observed_at":"2026-08-08T16:41:11.398946Z","submitted_at":"2020-05-16T17:13:28Z","title":"The INTERSPEECH 2020 Far-Field Speaker Verification Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.08046","snapshot_observed_at":"2026-08-10T20:25:17.175876Z","title":"The interspeech 2020 far-field speaker verification challenge","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.175876Z"},"links":{"cited_paper":"/paper/2005.08046","citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:5273c0edd3405b7d54e7df87f40bf10243f1bb0c05e197f8ee0b88c51dbeafc7","observation_id":"ee864b9c-1c25-495d-b7b8-74a299dfdb94","resolution":{"observed_at":"2026-08-10T20:25:17.175876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.812102Z","title":"Multi-channel speaker verification with conv-tasnet based beamformer","venue":null,"work_id":"1848500b-3ae7-4215-aa68-f75db4927431","year":2022},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.180413Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:442f2c1ca50c94f3c1e868e9237b65d20aae7c0bd16f8b2c18fb92c76231bef5","observation_id":"7875d4f7-8170-43ba-bb19-0ab0d0da6922","resolution":{"observed_at":"2026-08-10T20:25:17.817732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05975","last_updated":"2022-03-28T11:51:16Z","snapshot_observed_at":"2026-07-06T11:57:00.024730Z","submitted_at":"2021-10-12T13:04:32Z","title":"Multi-Channel Far-Field Speaker Verification with Large-Scale Ad-hoc Microphone Arrays","version":3},"cited_work":{"arxiv_id":"2110.05975","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.05975","snapshot_observed_at":"2026-08-10T20:25:17.419104Z","title":"Multi-Channel Far-Field Speaker Verification with Large-Scale Ad-hoc Microphone Arrays","venue":"cs.SD","work_id":"e124080e-fe9a-415a-827a-43bd1e96a97c","year":2021},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.184691Z"},"links":{"cited_paper":"/paper/2110.05975","citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:af91ffe6dd007be6e72e4551eafd75113e1625434b2b5d4640b37a868a306621","observation_id":"365b8ea8-4f34-4d7f-bebc-c4cae7fa7bb1","resolution":{"observed_at":"2026-08-10T20:25:17.424043Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.798451Z","title":"Unet-densenet for robust far-field speaker verification","venue":null,"work_id":"8e34ea72-31f9-44a0-b3f4-014c1a99468b","year":2022},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.189068Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:0a6a4b09d7fee054b16f0bf222a5f49c4317feaa285fc1f2a87e127bbc5de81c","observation_id":"d8895ca0-d14f-4aee-9ca1-a7a822bfbc50","resolution":{"observed_at":"2026-08-10T20:25:17.802967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.784273Z","title":"Dereverberation and beamforming in robust far-field speaker recognition","venue":null,"work_id":"a5e93110-aff6-4607-b24b-f88b9afaa916","year":2018},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.193467Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:3c7ffe1e02b7c39923e0418c1e3132f5ed34839e985a6ac624fccdbcd0dac6e4","observation_id":"536886ba-af4b-4459-9e1a-45b3c51ae5a6","resolution":{"observed_at":"2026-08-10T20:25:17.789298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.771064Z","title":"Far-field end-to-end text- dependent speaker verification based on mixed training data with transfer learning and enrollment data augmentation","venue":null,"work_id":"91759eef-922c-4ade-9d29-821cffd409fd","year":2019},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.197702Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:f6feff329f653c652b406e560fa5971079320e9d5613f9b4a194c8101e1d7298","observation_id":"dfe807bb-0132-490a-953e-780409249d4c","resolution":{"observed_at":"2026-08-10T20:25:17.775708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.757507Z","title":"Stc-innovation speaker recognition systems for far- field speaker verification challenge 2020","venue":null,"work_id":"a29b0b83-56df-485b-bb50-c415df9a0de5","year":2020},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.201863Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:25eff691b7a776cb535fb60df7e9ee4894c0f093cc0138705fd501b943555e08","observation_id":"3948982b-7f12-4cfe-b516-6aabb0bf381f","resolution":{"observed_at":"2026-08-10T20:25:17.762207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.744171Z","title":"Npu-hc speaker verification system for far-field speaker verification challenge 2022","venue":null,"work_id":"df1aee31-9a43-461d-a915-4b5a8767cee5","year":2022},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.205898Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:9b18adcca219d64f0d727d59e74f55f4ea7630e9ea2f2b135189970375c16626","observation_id":"429b0b3c-1e80-4c3e-bf81-a3ca6712b633","resolution":{"observed_at":"2026-08-10T20:25:17.748476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08779","last_updated":"2019-12-03T18:19:07Z","snapshot_observed_at":"2026-08-11T22:56:31.055611Z","submitted_at":"2019-04-18T17:53:38Z","title":"SpecAugment: A Simple Data Augmentation Method for Automatic Speech Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08779","snapshot_observed_at":"2026-08-10T20:25:17.209834Z","title":"Specaugment: A simple data augmentation method for automatic speech recognition","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.209834Z"},"links":{"cited_paper":"/paper/1904.08779","citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:bb683ca3414fffc9a8121aaebb1570f8080dfade4118a6ca70080f7511ba2c7c","observation_id":"4012f9d8-3fcf-4840-a6e4-8a5fdca92675","resolution":{"observed_at":"2026-08-10T20:25:17.209834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.730200Z","title":"Robust speaker verification using population-based data augmentation","venue":null,"work_id":"0a8ac3c7-2d09-42ff-b71b-d54bfd979fa3","year":2022},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.214748Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:606edc3b98ef500f29d72cf9ff726327b00e1a500acdfe2d4484dc4426a3e88c","observation_id":"ebecec8f-489f-4c80-8989-941eaa9df882","resolution":{"observed_at":"2026-08-10T20:25:17.734943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.715793Z","title":"Distance-based weight transfer for fine-tuning from near- field to far-field speaker verification","venue":null,"work_id":"1891d5c4-0c4a-4093-a9af-a3f41f503e1d","year":2023},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.219482Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:7d57a29c115a3cbd7ba473cedf90a8a5b8a7ce1bd217dbe621dfa24e10a9e508","observation_id":"a6b0417d-0f4b-49b5-ab6f-6ea67e102e87","resolution":{"observed_at":"2026-08-10T20:25:17.720508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03100","last_updated":"2024-04-23T08:38:03Z","snapshot_observed_at":"2026-08-10T22:41:15.281948Z","submitted_at":"2024-03-05T16:35:25Z","title":"NaturalSpeech 3: Zero-Shot Speech Synthesis with Factorized Codec and Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03100","snapshot_observed_at":"2026-08-10T20:25:17.223749Z","title":"Naturalspeech 3: Zero-shot speech synthesis with factorized codec and diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.223749Z"},"links":{"cited_paper":"/paper/2403.03100","citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:fbb17ea88515342768973380ab400351ee506e96d950841757d0d43e21830e37","observation_id":"1cc1c535-60c4-4c1c-94ca-d673d0e49ad7","resolution":{"observed_at":"2026-08-10T20:25:17.223749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.700716Z","title":"X-vectors: Robust dnn embeddings for speaker recognition","venue":null,"work_id":"28bc7698-0235-40ba-8958-9877aad9a774","year":2018},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.228108Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:a160993cc43aa8a6ae3290a99dd893e08e2e2490e2cdfb2e2cd9c4d706fc60bf","observation_id":"3b371a24-8027-4ced-a5b4-97cca5032c52","resolution":{"observed_at":"2026-08-10T20:25:17.705569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.685449Z","title":"Specaugment impact on automatic speaker verification system","venue":null,"work_id":"c04cde24-63ca-4602-a83c-15669bd0c827","year":2019},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.232209Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:cc1f99d23b4464b027ba5614903c771572ad42ed1e864c6af73006c72ecfb767","observation_id":"5e004615-d655-4e46-a825-bff543b31d02","resolution":{"observed_at":"2026-08-10T20:25:17.690202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.05562","last_updated":"2022-01-14T17:09:22Z","snapshot_observed_at":"2026-07-06T12:27:25.910874Z","submitted_at":"2022-01-14T17:09:22Z","title":"Investigation of Data Augmentation Techniques for Disordered Speech Recognition","version":1},"cited_work":{"arxiv_id":"2201.05562","doi":null,"metadata_source":"pith","pith_arxiv_id":"2201.05562","snapshot_observed_at":"2026-08-10T20:25:17.367752Z","title":"Investigation of Data Augmentation Techniques for Disordered Speech Recognition","venue":"cs.SD","work_id":"e6d065f8-7738-4417-86bf-c3dee148054e","year":2022},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.236441Z"},"links":{"cited_paper":"/paper/2201.05562","citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:8cd3b68c1d178c194add3a95c099f88532fc303edb08bc4acc7caaec96f5c417","observation_id":"28696dba-c2a2-4158-a691-16dc77ce8c67","resolution":{"observed_at":"2026-08-10T20:25:17.375443Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.671210Z","title":"Improved far-field speaker recognition method based geometry acoustic simulation and specaugment","venue":null,"work_id":"b378fdda-0fa9-4c56-b44f-302b1898e528","year":2021},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.240752Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:d9192796cfe2fef8f9f14386f0a0649a37f67fa7b2e428fe9d7a95114d85be98","observation_id":"bb4c3950-397f-44c3-b2be-12465c1d428d","resolution":{"observed_at":"2026-08-10T20:25:17.676106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.655714Z","title":"A study on data augmentation of reverberant speech for robust speech recognition","venue":null,"work_id":"0c98a391-5d98-4050-ba40-1a295fbea5fc","year":2017},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.244825Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:92d9e48e866abe5ffa1e133d4e94251712e39057aba7b0266bf63bd4f238d07d","observation_id":"196ac8ea-e2fe-437b-ace5-ee3fde021ba4","resolution":{"observed_at":"2026-08-10T20:25:17.660945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.640296Z","title":"Synaug: Synthesis-based data augmentation for text-dependent speaker verification","venue":null,"work_id":"0f890d7f-03f0-407c-8025-25317c9dc7b9","year":2021},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.248694Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:16adcc31dbdeab523c489ed09a3162268685cc2ff244ef71efaeb98ef7200f7c","observation_id":"b0f26a8b-1cd6-4afd-959e-5226bbb0ef0c","resolution":{"observed_at":"2026-08-10T20:25:17.645044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.625414Z","title":"Overcoming data scarcity in speaker identification: Dataset augmentation with synthetic mfccs via character-level rnn","venue":null,"work_id":"275103ba-5ce4-4658-9c5a-ced98b4e8ed3","year":2020},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.253223Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:40a7496d9a0cb0ed0054f5c4a7bd1b7ebcadf744ba7aec4c6775c22a5a081209","observation_id":"4559d649-57e4-4143-bc22-815cad922439","resolution":{"observed_at":"2026-08-10T20:25:17.630364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.611248Z","title":"Data augmentation using deep generative models for embedding based speaker recognition","venue":null,"work_id":"cd5daf6a-beb3-4a62-b498-11d999d31bca","year":2020},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.257698Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:334f0a0c37790f108a499ab07fc841058388225df62429344495422d5d5ad685","observation_id":"1b162294-a0f0-4806-b654-8306b4797448","resolution":{"observed_at":"2026-08-10T20:25:17.615870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.597355Z","title":"Data Aug- mentation Using Variational Autoencoder for Embedding Based Speaker Verification","venue":null,"work_id":"ad315962-34df-46af-be68-64ec80f6b9bd","year":2019},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.262615Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:c334b99f3ad2079ab0ff7d4ab222d73fabc4578363e7af7d202f68630513b2b6","observation_id":"0783bf5d-5b27-4282-b881-f0b4a45f8e1c","resolution":{"observed_at":"2026-08-10T20:25:17.601870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.583387Z","title":"Stargan-vc based cross- domain data augmentation for speaker verification","venue":null,"work_id":"b2e4451c-07b7-4f37-9ae1-8b41fe4140bf","year":2023},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.266943Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:8abb393e2f2c2ae8bf58f5a786cffd700cdafb632b7f83fa190b28977fdb02aa","observation_id":"5f382f9e-99d8-4a98-a0fc-bc15f65fc0d7","resolution":{"observed_at":"2026-08-10T20:25:17.587994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.07143","last_updated":"2020-08-10T13:50:24Z","snapshot_observed_at":"2026-08-07T15:21:18.262728Z","submitted_at":"2020-05-14T17:02:15Z","title":"ECAPA-TDNN: Emphasized Channel Attention, Propagation and Aggregation in TDNN Based Speaker Verification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.07143","snapshot_observed_at":"2026-08-10T20:25:17.270988Z","title":"Ecapa- tdnn: Emphasized channel attention, propagation and aggregation in tdnn based speaker verification","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.270988Z"},"links":{"cited_paper":"/paper/2005.07143","citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:88b501d7fca3b7a5cc589c2a1da1e8e80f4a2b2a94a043a80aacd53e05b6478f","observation_id":"71c21363-e3c0-44e4-a9fe-2ecaa9978b3b","resolution":{"observed_at":"2026-08-10T20:25:17.270988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.275203Z","title":"Arcface: Additive angular margin loss for deep face recognition","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.275203Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:959f3fbb0ed8be789a9c6a3d755062bfddfa607b2fe7c7471bd9c86aa28ab86c","observation_id":"82d55401-fefa-4ab1-82a8-2fb352a0e603","resolution":{"observed_at":"2026-08-10T20:25:17.275203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1510.08484","last_updated":"2015-10-28T20:59:04Z","snapshot_observed_at":"2026-07-06T04:34:36.474437Z","submitted_at":"2015-10-28T20:59:04Z","title":"MUSAN: A Music, Speech, and Noise Corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.08484","snapshot_observed_at":"2026-08-10T20:25:17.279531Z","title":"Musan: A music, speech, and noise corpus","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.279531Z"},"links":{"cited_paper":"/paper/1510.08484","citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:c0990c299a91d1752dda1c09a4779c9b21efd775d48ce81a3b0a5fa7b551f128","observation_id":"db96e626-c3f9-42b1-a358-be851f347be4","resolution":{"observed_at":"2026-08-10T20:25:17.279531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.558968Z","title":"Room impulse response generator","venue":null,"work_id":"75880d25-2b93-470f-ab95-ef9aa4553469","year":2006},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.283774Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:2f8a66d0e0ce92bff68c3ee74aa24dd905f1dc0bc6022568e6110ea2f4acbe3b","observation_id":"cbec8dd2-aa82-468d-88ac-ae4769a64379","resolution":{"observed_at":"2026-08-10T20:25:17.564580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.543625Z","title":"Speaker augmentation and bandwidth extension for deep speaker embedding","venue":null,"work_id":"92d5abc2-bd58-4970-bb1a-8b5b77497080","year":2019},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.288452Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:88c1b08eeb2e76356321f06e156972908a7e0f40d4872ef46eee5e712b0a0ca7","observation_id":"74d30273-8485-45d4-892f-3acc35da86bd","resolution":{"observed_at":"2026-08-10T20:25:17.548203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.527300Z","title":"Shuffleaug- ment: A data augmentation method using time shuffling","venue":null,"work_id":"051052fc-9f57-48bc-b80c-ba7e80a4279c","year":2023},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.292680Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:2e913016c94807732d13b086a9d54f3829618c4e0020120a5691f3b901e2402d","observation_id":"1b66f012-633f-42a2-a914-fa0120144cc3","resolution":{"observed_at":"2026-08-10T20:25:17.533341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.512523Z","title":"Filteraugment: An acoustic environmental data augmentation method","venue":null,"work_id":"8ac68ddf-139c-4734-9430-cc7689935cdb","year":2022},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.296891Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:1949011310358dbdca4702b20c078b88de9b890118cbca8a78ac9c37b25e9f07","observation_id":"25368803-858d-4961-b62d-940a723f9d32","resolution":{"observed_at":"2026-08-10T20:25:17.517080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.498394Z","title":"Stargan-vc based cross- domain data augmentation for speaker verification","venue":null,"work_id":"0af918fa-7d6e-4934-9cf9-74c59289777a","year":2023},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.300989Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:4cb19547b642db5ebe71efe65769bb8786cab4f72737345dace466376c8f38f4","observation_id":"a3425cc2-0ed7-43f6-89c3-ef075f0317b3","resolution":{"observed_at":"2026-08-10T20:25:17.503050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.483654Z","title":"Blind estimation of reverberation time","venue":null,"work_id":"d992edcd-a780-4f1f-af75-9d5a9abf9453","year":2003},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.304984Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:5f765f77508bf53db052300401d8d8e343bce9ce626a974d2bbc201a9f4cf614","observation_id":"4f3d2d02-b3de-4b10-8441-76c23fa6b091","resolution":{"observed_at":"2026-08-10T20:25:17.488701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-10T20:17:46.331003Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":3,"verified_fuzzy":30},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2501.08691."}