{"as_of":"2026-08-22T22:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3ba38ddd6a3a8195000a10797d3a2107412a7dc5d069e592bee680947b253ed4","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T05:35:09.656991Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T05:35:09.423408Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-12T05:35:09.716364Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"cited_work":{"arxiv_id":"2412.00319","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.00319","snapshot_observed_at":"2026-08-12T05:35:09.716364Z","title":"Improving speaker verification robustness with synthetic emotional utterances","venue":"cs.SD","work_id":"72b4f6f7-3ebd-471d-adb4-b931b6033617","year":2024},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.423408Z"},"links":{"cited_paper":"/paper/2412.00319","citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:85241fdcd5f0aa8582f8fa46d352ff0fa5a3e7ec610b348494397a739a79c293","observation_id":"21bb89a5-1d66-419d-988a-74300d4636de","resolution":{"observed_at":"2026-08-12T05:35:09.723384Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.00319/citation-record","integrity":"/paper/2412.00319/integrity","json":"/paper/2412.00319/citation-record.json","paper":"/paper/2412.00319"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"cited_work":{"arxiv_id":"2412.00319","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.00319","snapshot_observed_at":"2026-08-12T05:35:09.716364Z","title":"Improving speaker verification robustness with synthetic emotional utterances","venue":"cs.SD","work_id":"72b4f6f7-3ebd-471d-adb4-b931b6033617","year":2024},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.423408Z"},"links":{"cited_paper":"/paper/2412.00319","citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:85241fdcd5f0aa8582f8fa46d352ff0fa5a3e7ec610b348494397a739a79c293","observation_id":"21bb89a5-1d66-419d-988a-74300d4636de","resolution":{"observed_at":"2026-08-12T05:35:09.723384Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.454323Z","title":null,"venue":null,"work_id":"1be42208-0b2b-4c60-a8cf-75895a287686","year":null},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.429085Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:297279d8ee65766ba2c01fcbb206f5280a895436435e365e835f0e7248fde683","observation_id":"87c46476-9958-452c-97e1-d449372869f5","resolution":{"observed_at":"2026-08-12T05:35:10.459249Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.439343Z","title":null,"venue":null,"work_id":"d099c283-a85d-4ff3-9662-6c5cea218e84","year":2000},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.434979Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:5817862e8d5506a66026c0df49e36549c51dd3386d747bb3c4b745c38fd6b1c0","observation_id":"43581f7d-46d2-42b0-a1f8-b2d48ba4b6de","resolution":{"observed_at":"2026-08-12T05:35:10.444486Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.424395Z","title":"50 neutral + 10 angry","venue":null,"work_id":"35c8010f-756d-4a6d-b08d-f2c39e96cd36","year":null},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.440639Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:818a253f4b66b5c3182ff70db41ba593ea75c52051fb714ba096bb6567aa102f","observation_id":"2a9e3021-3695-42b6-abd2-f5360b572610","resolution":{"observed_at":"2026-08-12T05:35:10.429315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.409715Z","title":null,"venue":null,"work_id":"c9cd53f2-9688-4ce4-860d-b58ac755460a","year":null},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.446176Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:8ca684cac92c853ee1b53d7a23146177f6cf0a7ff4e41c1be49529b9acce1653","observation_id":"b930244b-e0ab-48a4-b2e4-c3d89807cfd6","resolution":{"observed_at":"2026-08-12T05:35:10.414461Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.394730Z","title":null,"venue":null,"work_id":"a04da658-5b07-43d5-9044-6731a0bb065a","year":null},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.451600Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:75aaed73d6d7a9b0b70c50cec5b64b00c05458ef841a635dd8306ddc555ffb68","observation_id":"b6b7c753-63b7-4465-bed0-99eabcf16bab","resolution":{"observed_at":"2026-08-12T05:35:10.399490Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.380306Z","title":null,"venue":null,"work_id":"93ede1e7-f0c2-4277-a795-cb6aeb7d0d71","year":2010},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.456987Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:3b0228a5e10e90ccc66d17a9e07e15b624138f9cf55476c8d80b748ef8a29b75","observation_id":"70f34c8b-9fbd-40be-ae47-690eef86e21b","resolution":{"observed_at":"2026-08-12T05:35:10.384846Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.365221Z","title":"A tutorial on text-independent speaker ver- ification,","venue":null,"work_id":"6290389d-dde8-4b04-84ef-eee7af724aa9","year":2004},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.461911Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:6073e7b1f65a323d0ec8245261c78e47c0881c6a0307b138f43217728f3c0164","observation_id":"3e751bc1-c138-4e41-9e5c-a99a1ffb20c1","resolution":{"observed_at":"2026-08-12T05:35:10.370479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.350210Z","title":"Speaker indexing in large audio databases using anchor models,","venue":null,"work_id":"cca44b7e-750b-4557-812c-a6dccd63b087","year":2001},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.466815Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:940724fb9536ae1976e63016c037b8c02d858578a4da4da95cca9178c07b5388","observation_id":"ade90d1d-f56a-4084-830f-c7ad7df534c0","resolution":{"observed_at":"2026-08-12T05:35:10.354966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.334743Z","title":"Speaker verification using support vector machines and high-level features,","venue":null,"work_id":"2ff1c448-e565-4b67-9722-129b7cbdc3a1","year":2007},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.472203Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:ff5f88726fa83e194aa0daf12f14fe65c7737f725838d3f4761fd044cd9dca94","observation_id":"1b907963-e3e9-4da7-b8bc-bcd23f5baece","resolution":{"observed_at":"2026-08-12T05:35:10.340155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.318369Z","title":"Rawnet: Advanced end-to-end deep neural network using raw waveforms for text-independent speaker verification,","venue":null,"work_id":"0f4d6df7-0378-4729-b20d-b640cd492682","year":2019},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.477524Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:a6f0e0869d2274375d9a98507cc92007ddc20b7506910abbbeef84c85ce8e348","observation_id":"42f5028b-ad48-4d90-9f50-ca02f61bc3a4","resolution":{"observed_at":"2026-08-12T05:35:10.323765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.304059Z","title":"Speaker diariza- tion with lstm,","venue":null,"work_id":"2cadd959-7666-4e13-9136-c5016adb07e3","year":2018},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.482401Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:9e83c82306e748b52ef7f97d15798f924ff0305d72486d361c2ebd141630027a","observation_id":"b0c0c265-0de2-41a9-b0fc-bb5c603234d4","resolution":{"observed_at":"2026-08-12T05:35:10.308865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.289600Z","title":"An overview of automatic speaker ver- ification system,","venue":null,"work_id":"703e37d8-d384-4531-867e-c7423e7d3ca0","year":2018},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.486844Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:4d28f781476d2448e3e0e5591844ce4255bd8348d5dce7650846deef924eecea","observation_id":"f1edc30b-2dc9-4459-80e7-02139ce3478f","resolution":{"observed_at":"2026-08-12T05:35:10.294329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.274676Z","title":"Ap- plications of speaker recognition,","venue":null,"work_id":"797dcc68-e8c1-4c56-8662-856eda36cc9d","year":2012},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.491676Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:3f5e2caaeefafdbf6b69a1e99ae26ec8479a0912895db47f060a1d77b7eac639","observation_id":"05d676e3-a8cd-4160-8a49-27ecd3bcf84f","resolution":{"observed_at":"2026-08-12T05:35:10.278959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.260135Z","title":"Emotional speaker identification using a novel capsule nets model,","venue":null,"work_id":"0f2a1f02-e370-41f4-a2e0-92bfa9bffcb1","year":2022},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.496407Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:8a9dec561b2977781bd13aa5c455e964574b963067fbb293a5b055c3e2a1938b","observation_id":"3905cb56-6282-4ac1-bac5-5fa36a459244","resolution":{"observed_at":"2026-08-12T05:35:10.265080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.244830Z","title":"Wearable emotion recognition using heart rate data from a smart bracelet,","venue":null,"work_id":"b7c3c079-fe1b-4ba3-a929-4208fed96d78","year":2020},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.500972Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:48a6c87708e09d02bfdf5d5987eef907e00ac2eea9f718ef3eda73fa7975a7a2","observation_id":"cd176ab3-c07e-4065-b47f-6d3db9ec1a19","resolution":{"observed_at":"2026-08-12T05:35:10.249690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.229881Z","title":"Physiologi- cal changes associated with emotion,","venue":null,"work_id":"612d892b-deef-402b-b1cd-33265ad92fbb","year":2001},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.505485Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:9b43b79888084f7732a1a0e9aab0b3bb28abbf49558dd0cbf801392e98a07558","observation_id":"7442e09c-892a-4e0c-a168-600d66122d51","resolution":{"observed_at":"2026-08-12T05:35:10.234566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.214601Z","title":"X-vectors meet emo- tions: A study on dependencies between emotion and speaker recognition,","venue":null,"work_id":"758bcb64-3f04-4d2c-be5d-45edecd98c48","year":2020},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.509976Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:5e906eca9b607aa6bd518d7e2ece185e2200d9438703a74e848e50ef846e7ed1","observation_id":"dc35f617-57bb-43f6-ba6d-9c9e615829ca","resolution":{"observed_at":"2026-08-12T05:35:10.219621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.199833Z","title":"Achieving fair speech emotion recognition via perceptual fairness,","venue":null,"work_id":"6758d0fd-54b2-410c-89b4-e7d154f38a1b","year":2023},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.514497Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:d29f89a76056ae3963058ed83565e3356f748e1b1ac3244e03ee88fd6757bcc1","observation_id":"c8c66b83-d761-4b2c-9e8a-47a8453483c1","resolution":{"observed_at":"2026-08-12T05:35:10.204776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.184518Z","title":"Gender-related dif- ferences in the production and perception of emotion,","venue":null,"work_id":"df938077-b7bb-446b-b9e8-3f34a674eb54","year":2008},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.518985Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:4dbde1c2bc6977f7abad8a0a47372048e630508b6b1509c76b863d250fa156a7","observation_id":"d57e92a5-7c99-403c-97bf-63c9830f8acd","resolution":{"observed_at":"2026-08-12T05:35:10.189670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.168885Z","title":"Demographic fair- ness in biometric systems: What do the experts say?,","venue":null,"work_id":"818c6ce3-8297-4a94-bff7-09f2a6b4f17d","year":2022},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.523335Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:44bbbfc95891baef2888516708a237dfcaaae8cf5ab077760004a083ee3f70e4","observation_id":"63e9f6cf-5b16-4ba3-aefe-eb3f317af86c","resolution":{"observed_at":"2026-08-12T05:35:10.173981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.152305Z","title":"Effects of emotional valence and arousal on the voice perception network,","venue":null,"work_id":"10800094-b1aa-4775-a8ed-2e8c0ab0e161","year":2017},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.528115Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:ee7b8d9a408610b24453263e2a1c23f58e8f7aa1699b4432e0ff7e1e97c8a43f","observation_id":"150c01fe-b859-4ac0-93e9-41764d724951","resolution":{"observed_at":"2026-08-12T05:35:10.157696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.137112Z","title":"Unveiling the acoustic properties that describe the valence dimension,","venue":null,"work_id":"e284ddfd-369c-4d04-b9fa-23998145e065","year":2012},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.532758Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:9aa0b3f7f92b2bf35bff5b54de79fa7bae375bf25c053787e393cb8ba9ad78d4","observation_id":"d66c90ab-22a9-4d59-a169-b19e9b2ea32d","resolution":{"observed_at":"2026-08-12T05:35:10.142152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.122198Z","title":"Generalized end-to-end loss for speaker verification,","venue":null,"work_id":"2d924c4e-90d0-439a-95cc-ebcae3901055","year":2018},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.537415Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:4a11790d4e05f26c89e17acd287759705f43c0d5a394229ecdfa06ee9459192a","observation_id":"b5ddc1b4-b838-45c4-b62c-1c97f7705048","resolution":{"observed_at":"2026-08-12T05:35:10.127102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.106668Z","title":"V oice conversion based on maximum-likelihood estimation of spectral parameter trajectory,","venue":null,"work_id":"211a2b77-3d81-4b43-8348-fbf203597865","year":2007},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.542158Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:7215f15b5505247a8788d15c877fea44e19faef22b5bfb9a8c0098a24f647f1c","observation_id":"ebdfe8df-91c7-4124-8971-7beb4628a226","resolution":{"observed_at":"2026-08-12T05:35:10.111642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.090098Z","title":"Algorithms for non- negative matrix factorization,","venue":null,"work_id":"45663fef-d258-4078-aeb3-89699797eb83","year":2000},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.546828Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:44d3f03d7504983a7a97b8aa9e7e0ab911dc1a0c018b4e7a46cc904f43aee8c8","observation_id":"c1c60472-9fad-42ef-bfc8-4c6d4aff2050","resolution":{"observed_at":"2026-08-12T05:35:10.095421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.070863Z","title":"Exemplar-based sparse representation with residual compensation for voice conversion,","venue":null,"work_id":"c3a569a7-f234-4417-8556-f947f3c3a136","year":2014},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.551480Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:a0dccc41f5c458f6aed4a8a3b1413aaff7d6bda0f14cf606b9bd1347fba2f1d3","observation_id":"31b10648-71cd-48f2-bd3b-9956a27e5711","resolution":{"observed_at":"2026-08-12T05:35:10.077571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.051529Z","title":"V oice conversion using deep neural networks with layer-wise generative training,","venue":null,"work_id":"902b6d2d-ee80-4834-9cfd-24898da4abbb","year":2014},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.556774Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:9350f42e02f54be64fb5e9568db0eb278ec63c85611f7d9be7a6755ec7198f3e","observation_id":"6d183fea-001d-42a6-be3d-35f01cfcd6ec","resolution":{"observed_at":"2026-08-12T05:35:10.056726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.035719Z","title":"Spectral mapping using artificial neu- ral networks for voice conversion,","venue":null,"work_id":"ac3c72c4-f882-42b3-9d3c-d7b569af9ae7","year":2010},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.561990Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:ff9caa3bd9011634deddfb045c6ebadccb5fe9f779b49d204e8d228405cb874d","observation_id":"c87f5e2c-6409-4262-bba1-0f1d6357b670","resolution":{"observed_at":"2026-08-12T05:35:10.040965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.018154Z","title":"V oice conversion in high-order eigen space using deep belief nets,","venue":null,"work_id":"c4706b88-24c8-4549-b59f-a7524ca5601f","year":2013},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.567038Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:d6a5b9f3bd0a0a2024dc71047037e47592aa2ff7146a7c2a469741e8094c875e","observation_id":"f35deae3-1007-49a5-bd16-a4267669d9bb","resolution":{"observed_at":"2026-08-12T05:35:10.023651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:10.001443Z","title":"On the use of i-vectors and average voice model for voice conversion without parallel data,","venue":null,"work_id":"5b595a2b-5049-4a26-a5dd-8b9996d81e86","year":2016},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.572355Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:0335903dd0f7b88bbb069140f5c6d9f2b8bec27deb77a33a36e62d000849b71a","observation_id":"a4eb2015-0786-49dc-89f3-25fd3d45c6f3","resolution":{"observed_at":"2026-08-12T05:35:10.006878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:09.986604Z","title":"Non-parallel voice conversion using variational autoencoders conditioned by phonetic poste- riorgrams and d-vectors,","venue":null,"work_id":"c7a48017-73ef-4b9e-8930-184eb8b919da","year":2018},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.577326Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:8e7907ff00ef440f40a24ebc069cf6b10ab33deb93f091c7547f63741fcfcffe","observation_id":"44534ec7-45c3-4c8c-9d49-42756edcb433","resolution":{"observed_at":"2026-08-12T05:35:09.991483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:09.970624Z","title":"V oice conversion from non-parallel corpora using variational auto-encoder,","venue":null,"work_id":"106767aa-5d6b-4005-b9a2-8593ed17a02e","year":2016},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.582097Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:e5c208b808818ce76270e4fb630228146b819a82ece58f491ca6872cef61894c","observation_id":"01893a47-56d5-423c-a655-e62bf1fe0890","resolution":{"observed_at":"2026-08-12T05:35:09.975732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.00849","last_updated":"2017-06-08T01:08:38Z","snapshot_observed_at":"2026-08-14T21:08:28.165840Z","submitted_at":"2017-04-04T01:47:14Z","title":"Voice Conversion from Unaligned Corpora using Variational Autoencoding Wasserstein Generative Adversarial Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.00849","snapshot_observed_at":"2026-08-12T05:35:09.586623Z","title":"V oice Conversion from Un- aligned Corpora using Variational Autoencoding Wasser- stein Generative Adversarial Networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.586623Z"},"links":{"cited_paper":"/paper/1704.00849","citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:e891914d2aa19aac64f99b574c6bb985230e9791cd07dd44ed5fd3b4d4d33ac1","observation_id":"6c7c211b-7ad1-41bd-abfa-5bd9db5fd7bd","resolution":{"observed_at":"2026-08-12T05:35:09.586623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:09.955068Z","title":"On the study of generative adversarial net- works for cross-lingual voice conversion,","venue":null,"work_id":"32075b90-bc63-43ae-a53d-a6cb33babd62","year":2019},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.591235Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:81ecd61fb1ff65d321e79014248c2c2bf97f9b70195743d93909bdb2a554ecd7","observation_id":"cc671dd9-a1c0-491e-9562-d87f8552615c","resolution":{"observed_at":"2026-08-12T05:35:09.960045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:09.939965Z","title":"Cyclegan-vc: Non-parallel voice conversion using cycle-consistent ad- versarial networks,","venue":null,"work_id":"1e0a2771-3eb3-4fe2-acaf-cbd134b27644","year":2018},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.595615Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:c544bf4363422b23d178fe62b763438fbccc57da9e17c090ff3acf6b83086eb6","observation_id":"3680c1a5-fe81-4131-83a6-5f62db17b228","resolution":{"observed_at":"2026-08-12T05:35:09.944910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:09.925758Z","title":"Transform- ing spectrum and prosody for emotional voice conversion with non-parallel training data,","venue":null,"work_id":"d9c92896-2b2b-4ecf-a6c0-9da61211728b","year":2020},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.600288Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:c7f6301a90a4e777024b856dad8b282ac67af49b1fa447e9e87f78af1d1abc8f","observation_id":"c524bfeb-239f-4cbb-839c-36c8f09d69c3","resolution":{"observed_at":"2026-08-12T05:35:09.930643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:09.910263Z","title":"Fusion of embeddings net- works for robust combination of text dependent and in- dependent speaker recognition,","venue":null,"work_id":"b013e783-9ea0-4a7c-81aa-b38e247a9d28","year":2021},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.605486Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:7592d77beeef61578e07a504fb884ab4b0007ad767568ea91a453ed462be7e86","observation_id":"092f5052-574d-4251-8bf8-510842057772","resolution":{"observed_at":"2026-08-12T05:35:09.915828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:09.894791Z","title":"Deep neural networks for small footprint text-dependent speaker verifi- cation,","venue":null,"work_id":"a30c0f34-f6b4-4bd8-a8c1-2cd0c6f6e527","year":2014},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.610232Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:38e327d6d74343014bbafd90c0ea6e3105ab7839fd67b9a9d6f50f41fbe87129","observation_id":"6237d49f-8229-4ea2-ab13-86f41763d00f","resolution":{"observed_at":"2026-08-12T05:35:09.899923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:09.879339Z","title":"World: A vocoder-based high-quality speech synthesis system for real-time applications,","venue":null,"work_id":"d189cf11-73bc-497a-8764-a95a2c15ebc4","year":2016},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.615220Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:4a5e7a043e56c8b2137e595d735bf5e41ea4b8108cf558996a62f241e0a55bfe","observation_id":"33972e8f-8bec-48fd-a4f4-e36081910ced","resolution":{"observed_at":"2026-08-12T05:35:09.884559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:09.863439Z","title":"Seen and unseen emotional style transfer for voice con- version with a new emotional speech dataset,","venue":null,"work_id":"3f6c19ed-7265-4a2e-9983-c25bf26f815a","year":2021},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.619965Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:fff2227398f411bacd1ef9f0e81bc634db6ff2707ccd8fa4c7dae427c4a116c9","observation_id":"f28f1bbb-2362-4f8e-a91c-c9a029e29d88","resolution":{"observed_at":"2026-08-12T05:35:09.868506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:09.848002Z","title":"The emotional voices database: Towards controlling the emotion dimension in voice generation systems,","venue":null,"work_id":"3526299c-a323-4186-b56d-72d8e31aa7d3","year":2018},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.624882Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:efe9fa6377701185cd7f19a51c73b90f09c13598db606f72b7fece2aa9e92eba","observation_id":"8a5f584b-247f-49aa-be8f-3ad7a89e19e0","resolution":{"observed_at":"2026-08-12T05:35:09.852898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:09.832471Z","title":"The ryer- son audio-visual database of emotional speech and song (ravdess): A dynamic, multimodal set of facial and vocal expressions in north american english,","venue":null,"work_id":"f495736f-a6d3-4b85-8bba-f417190a2790","year":2018},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.629589Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:684089d8b8235166029ba044b42ea4b108f4bdf930f6b40678d39fd9c1f6d213","observation_id":"5fc35a2e-3952-46d3-9faf-b1219e0f546d","resolution":{"observed_at":"2026-08-12T05:35:09.837627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:09.816896Z","title":null,"venue":null,"work_id":"4b5b8b6a-15c4-44df-b0e2-89257d8ca38c","year":2012},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.634141Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:9b68937165fd5a6e0993a2e88c79884bbd5f428c2ea418cf643ab7da70c4ca36","observation_id":"b934f128-f9da-4df7-a8a4-65238fcd6f8a","resolution":{"observed_at":"2026-08-12T05:35:09.821960Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:09.798255Z","title":"Towards principled methods for training generative adversarial networks,","venue":null,"work_id":"f5f41ac7-50bc-4bc6-9560-b6e8f3373403","year":2017},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.638677Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:b20e7c23720a47c8c7d37b5b1808a521789c978d99dc368cd4baffd9fd16dcb8","observation_id":"e51c3bd1-ab9d-4f4f-aef2-0e4a87dddb76","resolution":{"observed_at":"2026-08-12T05:35:09.803719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:09.782672Z","title":"Generative adversarial nets,","venue":null,"work_id":"6a53a9a4-100f-41c9-9845-2fbf7d7cbf24","year":2014},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.643529Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:d6d7046cd39c6297b94a3252552352b57e95bec353d64470fff0f7fad9d30a65","observation_id":"6dfb2b91-36e5-4852-81e1-5567c0256d51","resolution":{"observed_at":"2026-08-12T05:35:09.787852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:09.766526Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":"ed035510-92cd-4a29-9ddd-9a2b53d8dc7f","year":2015},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.648191Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:f7994bb109e6799883f0ebc52371495ec90a3834dfa36db7cde9a7896b39d8bb","observation_id":"bf22a265-fe85-43da-ba8d-8d749e7a507f","resolution":{"observed_at":"2026-08-12T05:35:09.771395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:09.750658Z","title":"Visualiz- ing data using t-sne,","venue":null,"work_id":"e1c776c7-f0b2-4590-8f43-3b107ba7dbff","year":2008},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.652678Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:8a0340c792de1a1d3808b74f29fc177571a5e2f3dd3b9ad3d69e82278c3f7f1e","observation_id":"a7c6c734-b527-4815-b848-2a15ec23ca7d","resolution":{"observed_at":"2026-08-12T05:35:09.755555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:35:09.734216Z","title":"Identifying source speakers for voice conversion based spoofing attacks on speaker verification systems,","venue":null,"work_id":"4dfda71f-2e5e-49fa-8a4d-b9fbe3b645d2","year":2023},"citing_paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T05:35:09.656991Z"},"links":{"citing_paper":"/paper/2412.00319"},"observation_digest":"sha256:6d2e441eb294bc40bc7f6bf3acf98e0ea963aea3dba474eff5190eb9871be1b6","observation_id":"133ceb26-6c49-4840-bfa2-20b4334eaeab","resolution":{"observed_at":"2026-08-12T05:35:09.739772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.00319","last_updated":"2024-11-30T02:18:26Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-15T04:28:43.091935Z","submitted_at":"2024-11-30T02:18:26Z","title":"Improving speaker verification robustness with synthetic emotional utterances"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":41},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 1 inbound Pith citation observation for arXiv:2412.00319."}