{"as_of":"2026-08-13T11:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c1efbc5c04b399b7e2518c36ca27ce1d7fcbee52be2cb8d1b0f103e98850c31c","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T04:41:55.073891Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.01195/citation-record","integrity":"/paper/2412.01195/integrity","json":"/paper/2412.01195/citation-record.json","paper":"/paper/2412.01195"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.987446Z","title":"Front- end factor analysis for speaker verification,","venue":null,"work_id":"4c7d8e5d-6595-46e7-93f8-65455072bf53","year":2011},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.819169Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:f278d2384c415487b7ab1bd2ff9be2765e835fe04a45d19d57dfaec945c96e71","observation_id":"9830a03b-2cd7-4905-a7f9-ec3ca4095c02","resolution":{"observed_at":"2026-08-12T04:41:55.992691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.971222Z","title":"Probabilistic linear discriminant analysis,","venue":null,"work_id":"56c725a6-2c0d-4afc-85e3-da035b7dd9b1","year":2006},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.826917Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:3b2fc515ffcd4372beb36ffbbddcd0c6351f9b9874d08e31cc78c1dad635a476","observation_id":"bdd23eed-625a-4190-99e2-953a9b3621f7","resolution":{"observed_at":"2026-08-12T04:41:55.976753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.955578Z","title":"Deep feature for text-dependent speaker verification,","venue":null,"work_id":"5b49e94a-ebf6-4fba-815d-58209ab93565","year":2015},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.832435Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:fe1ebe570e3d503bc86b4364eb3e796e2e8c78cd6a46f852b1bb2f6e7835b038","observation_id":"2066fc5b-1ed3-465f-a74a-c1ce55350c66","resolution":{"observed_at":"2026-08-12T04:41:55.960554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.939977Z","title":"X-vectors: Robust dnn embeddings for speaker recognition,","venue":null,"work_id":"9f98d5be-a003-4772-b0ab-e24a65dfff85","year":2018},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.838917Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:2b439b0abf66338fc416e429591023a9579ec00238cb25e252c94ee11e6e369d","observation_id":"2c291556-f8a3-429f-b8d1-3e7e473efa95","resolution":{"observed_at":"2026-08-12T04:41:55.944823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.924020Z","title":"Deep neural network embeddings for text-independent speaker verification,","venue":null,"work_id":"31246cb6-9011-4498-888a-8ccd179789c9","year":2017},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.843827Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:3f2e1f10225214272a51b4583a62cc13e4c3946563a3d7aeb35c00b889726dc1","observation_id":"8b170c2e-eab2-4a92-8eab-be1df5098478","resolution":{"observed_at":"2026-08-12T04:41:55.929221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.908171Z","title":"Speaker recognition for multi-speaker conversations using x-vectors,","venue":null,"work_id":"56b4b674-3733-4e41-bacf-eb30319a43b8","year":2019},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.848597Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:15eb6fda2746daa2e32fdefc54b0730caa096d2203a9cb3b489b7394c94157b9","observation_id":"b2ad5785-88bb-46a2-aebd-eee8bd55c36d","resolution":{"observed_at":"2026-08-12T04:41:55.913120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.12592","last_updated":"2019-10-16T11:27:27Z","snapshot_observed_at":"2026-08-09T06:19:25.884792Z","submitted_at":"2019-10-16T11:27:27Z","title":"BUT System Description to VoxCeleb Speaker Recognition Challenge 2019","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.12592","snapshot_observed_at":"2026-08-12T04:41:54.853672Z","title":"But system description to voxceleb speaker recognition challenge 2019,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.853672Z"},"links":{"cited_paper":"/paper/1910.12592","citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:85adeaa4fbebf789561772f56a4a81b261713ec642b658c13cd80a02fdc96895","observation_id":"892bb1d6-af85-4127-ab05-1a08e58b0671","resolution":{"observed_at":"2026-08-12T04:41:54.853672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.891792Z","title":"Densely connected time delay neural network for speaker verification,","venue":null,"work_id":"26c8801c-75a2-44c8-9924-f3f2a2aa8948","year":2020},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.858547Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:e26bbe93a3a46d5a009e62b887ebce23b878a10929e36c4ad4d7efbaa4d8fc1d","observation_id":"f87a2402-a7c0-44bf-bf30-90f192c35a86","resolution":{"observed_at":"2026-08-12T04:41:55.896715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.874169Z","title":"Ecapa-tdnn: Em- phasized channel attention, propagation and aggregation in tdnn based speaker verification,","venue":null,"work_id":"c4559570-b492-4047-b284-776b39c34207","year":2020},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.863388Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:dcad7ea7d1ba54ca1db4982dd9f77db1ba20cd8dce8dba0a77ef3816fdef1af6","observation_id":"f98e5e8a-fd98-4f6d-91ab-430a27f519ef","resolution":{"observed_at":"2026-08-12T04:41:55.879751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.858544Z","title":"Ecapa++: Fine-grained deep embedding learning for tdnn based speaker verification,","venue":null,"work_id":"a366f949-2e73-4c89-a6d4-5d01665658f8","year":2023},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.867745Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:c2066fc736ea274e1949e1d9b4aab879fceebbceb3ff984ac96cd665e098604f","observation_id":"9b3e72ad-0623-4a63-8977-d972844c7d2d","resolution":{"observed_at":"2026-08-12T04:41:55.863692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.842208Z","title":"An effective deep embedding learning method based on dense-residual networks for speaker verification,","venue":null,"work_id":"66567a67-3d2a-4909-a814-9e47dc6acb3c","year":2021},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.872289Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:3c0d153f6bcab174127f4c09a9fe7b3ecde5fdb43660097d5c2c9a16ffdfaec8","observation_id":"b0f69242-b943-4bc0-b29a-4d09ea75bd35","resolution":{"observed_at":"2026-08-12T04:41:55.847906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.825543Z","title":"Self-knowledge distillation via feature enhancement for speaker verification,","venue":null,"work_id":"05568571-29bc-44c2-9a53-3e33522400af","year":2022},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.876982Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:62c0b30bb7c25dba6686a65e1ea65f32a7179bba1a73983f933ccf267bf838aa","observation_id":"76c52fd9-2a62-4827-844c-c28cb580e5fd","resolution":{"observed_at":"2026-08-12T04:41:55.830509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.809916Z","title":"Adaptive convolutional neural network for text-independent speaker recognition,","venue":null,"work_id":"9471689f-b141-49f1-8ca6-e49bb9e52fe8","year":2021},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.881610Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:4068f5bc7f5477e02a1b971a78364bebd7eaf45060faa18bb151312048cf7c00","observation_id":"809b695c-9a99-4952-8855-13a2190b6959","resolution":{"observed_at":"2026-08-12T04:41:55.814833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.793917Z","title":"Df-resnet: Boosting speaker verification performance with depth-first design,","venue":null,"work_id":"74986381-8e36-4f11-8d51-ede75f859d3d","year":2022},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.886213Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:1d28e8d8cacae994b6ef716419c659de1f225d4bd1d02b2a067365099a33b9d3","observation_id":"bafb2a08-21a3-4282-91f9-308c6fe344f5","resolution":{"observed_at":"2026-08-12T04:41:55.799033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.778134Z","title":"Depth-first neural architecture with atten- tive feature fusion for efficient speaker verification,","venue":null,"work_id":"dc2410c7-f367-417a-a88c-5ed3a6c86d7a","year":2023},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.890832Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:b355ed1b52f023a14b1c58a4b1d03c5349c15eb06d6127af60c67b69709ec0a4","observation_id":"8b7b9866-a03d-40c9-b2bc-bcb6bf0d5860","resolution":{"observed_at":"2026-08-12T04:41:55.783204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.761799Z","title":"Mlp-svnet: A multi-layer per- ceptrons based network for speaker verification,","venue":null,"work_id":"3da0900e-b82a-487a-a74d-dd3feb6f473a","year":2022},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.895275Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:77b6be85b68ba9ad1d10ce1f116ab952027e114a796ebf64137773653543c11f","observation_id":"cfc59ab2-964e-427c-ae83-9a368ca8038d","resolution":{"observed_at":"2026-08-12T04:41:55.767105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:54.899773Z","title":"Attentive statistics pooling for deep speaker embedding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.899773Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:1eb037db515455fbefa54ab12d8381b372dc6585ee0d11b440269fdb10b7b556","observation_id":"6c233823-5819-4848-bb29-42777875a23d","resolution":{"observed_at":"2026-08-12T04:41:54.899773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.735430Z","title":"Self-attentive speaker embeddings for text-independent speaker verification,","venue":null,"work_id":"af0c6aed-9b79-4edb-b7d7-0e4fa89fe49c","year":2018},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.905468Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:92f06ca2612efab381ef24b609959eebe4db3cc010c65c6cd183fe76b8b0affa","observation_id":"fcb50a5c-6cab-4b93-a4ad-cbcd691bf234","resolution":{"observed_at":"2026-08-12T04:41:55.740710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.719793Z","title":"Self multi-head attention for speaker recognition,","venue":null,"work_id":"9a1b4a83-d48e-46ec-8403-01113645432b","year":2019},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.910362Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:59d36d0846cbf3cc8519ff2e33f051054a91a37b9d54e26b01c59a7fce9ba671","observation_id":"9c7ae27d-f2e5-419b-8de2-85b00cdfa776","resolution":{"observed_at":"2026-08-12T04:41:55.724885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.702837Z","title":"Improving aggregation and loss function for better embedding learning in end-to- end speaker verification system,","venue":null,"work_id":"81a061ca-99aa-4d4b-995f-3b440b01909c","year":2019},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.916593Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:a754e5946d2950ebbeaf9fed851e958724fd4683f80d0b6323b2a97641ba1c40","observation_id":"7879d606-6713-4423-84ca-531dacb7e285","resolution":{"observed_at":"2026-08-12T04:41:55.708038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.687018Z","title":"Revisiting the statistics pooling layer in deep speaker embedding learning,","venue":null,"work_id":"672b2625-9c65-4ed7-a257-ce2c10cfc547","year":2021},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.922469Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:1a7cc936f83dd7d5ff3c6ac06172682dcd4a39f1c3e6bd41c3f62d2bb9da457b","observation_id":"e6485b1d-5578-40b6-9985-8f1fb588817d","resolution":{"observed_at":"2026-08-12T04:41:55.692046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.669468Z","title":"End-to-end text-independent speaker verifi- cation with triplet loss on short utterances","venue":null,"work_id":"f1e2eb2a-bb8c-4c6a-a41e-ff876314f015","year":2017},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.927396Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:844ff2cc76c0cdaf71f68466e7bc8a285fc1832d18ff805a8a4819166339236b","observation_id":"296d3e3a-c5af-4745-8459-b6d167fe6494","resolution":{"observed_at":"2026-08-12T04:41:55.675579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.07317","last_updated":"2019-06-18T00:31:04Z","snapshot_observed_at":"2026-07-06T08:00:58.352724Z","submitted_at":"2019-06-18T00:31:04Z","title":"Margin Matters: Towards More Discriminative Deep Neural Network Embeddings for Speaker Recognition","version":1},"cited_work":{"arxiv_id":"1906.07317","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.07317","snapshot_observed_at":"2026-08-12T04:41:55.255358Z","title":"Margin Matters: Towards More Discriminative Deep Neural Network Embeddings for Speaker Recognition","venue":"eess.AS","work_id":"1efab370-b053-4da0-81a2-d9fcbfe8d589","year":2019},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.937215Z"},"links":{"cited_paper":"/paper/1906.07317","citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:f91c55deea73d40faa0bda5c7538dada2ff6b1ac423ec5cbad657ce79b94eeec","observation_id":"4d363351-edae-4b83-814a-1bf2fe31cf08","resolution":{"observed_at":"2026-08-12T04:41:55.261239Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.635271Z","title":"Real additive margin softmax for speaker verification,","venue":null,"work_id":"9496a13c-18ce-4d7c-8540-fe4b9ddef6cc","year":2022},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.942392Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:ac9b12b4c4ebc590432b2413f656e3aea5ad70aac8f48ebdb43ef3035e61fb31","observation_id":"a4a3fdb8-ebda-48a4-8ed7-79fd52fd9611","resolution":{"observed_at":"2026-08-12T04:41:55.642186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:54.947040Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.947040Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:f1fe250c29a8790f6034c0bc8476762edfc2fcd0f9ae508e033879e4d9f65818","observation_id":"7a4b9269-565d-4ac6-b21a-621866b430a0","resolution":{"observed_at":"2026-08-12T04:41:54.947040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.608219Z","title":"Attentive feature fusion for robust speaker verification,","venue":null,"work_id":"1edc2738-6043-4f25-95d5-423edad5f835","year":2022},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.951908Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:029a3b288cd575c78699dbfb8054abf04d85494ed627f4a36c4b6fe74da72fb2","observation_id":"e8755960-cd58-4575-93dd-8cd9f5b138f0","resolution":{"observed_at":"2026-08-12T04:41:55.613615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.592271Z","title":"Simple attention module based speaker verification with iterative noisy label detection,","venue":null,"work_id":"41edccb9-ec3b-4d03-a1e8-4418121f4e2d","year":2022},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.956675Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:f2f0659b7d94d98be59c09a3d96f8b512efd9ed4c450088475826c53f7bbed1d","observation_id":"8fff76fe-4c10-48d3-ac41-785a5b2b767e","resolution":{"observed_at":"2026-08-12T04:41:55.597429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.576313Z","title":"Dual path embedding learning for speaker verification with triplet attention,","venue":null,"work_id":"dd87c485-71f1-44d9-9bee-551920550c71","year":2022},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.961040Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:1f112d82b3fec93f27667dc2cae1326b7aadfa9ad2310d1c652693e1ef563a20","observation_id":"96b7a525-d2ac-4b4d-a7ad-8004b11e280f","resolution":{"observed_at":"2026-08-12T04:41:55.581549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.560075Z","title":"Repvgg: Making vgg-style convnets great again,","venue":null,"work_id":"ed4bea3a-3f6e-4118-a69f-0d67bb63ea05","year":2021},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.965258Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:57db3b71a9f9669ce054ed5694ccd6dc29b96bf7087bdb46b721af45f4800824","observation_id":"ddcb79e6-aeed-47d5-85da-481884ec37da","resolution":{"observed_at":"2026-08-12T04:41:55.565209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.11699","last_updated":"2023-05-14T07:25:54Z","snapshot_observed_at":"2026-07-06T13:23:58.699976Z","submitted_at":"2022-06-23T13:40:59Z","title":"The SJTU X-LANCE Lab System for CNSRC 2022","version":5},"cited_work":{"arxiv_id":"2206.11699","doi":null,"metadata_source":"pith","pith_arxiv_id":"2206.11699","snapshot_observed_at":"2026-08-12T04:41:55.230555Z","title":"The SJTU X-LANCE Lab System for CNSRC 2022","venue":"cs.SD","work_id":"57c37eaf-c913-44bd-9df6-73b7dc3d814b","year":2022},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.969875Z"},"links":{"cited_paper":"/paper/2206.11699","citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:588ecf49033e4ec8fedd2efb441f638b5bf81a44b086d2f17f83e1382803432e","observation_id":"dc8dc349-124a-45c5-8038-4b312a527ce0","resolution":{"observed_at":"2026-08-12T04:41:55.236990Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.09076","last_updated":"2022-09-20T15:33:18Z","snapshot_observed_at":"2026-08-10T20:35:34.588199Z","submitted_at":"2022-09-19T15:06:42Z","title":"SJTU-AISPEECH System for VoxCeleb Speaker Recognition Challenge 2022","version":2},"cited_work":{"arxiv_id":"2209.09076","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.09076","snapshot_observed_at":"2026-08-12T04:41:55.200116Z","title":"SJTU-AISPEECH System for VoxCeleb Speaker Recognition Challenge 2022","venue":"cs.SD","work_id":"792c1170-1334-4cb8-891b-9fa78031d302","year":2022},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.974714Z"},"links":{"cited_paper":"/paper/2209.09076","citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:dff9f6b73f1ccdc2eb319eea86f4fe02b4f26becb74a1d095adb5ade28df2c2b","observation_id":"3df81298-dee6-4ad6-9b95-5c87a027a645","resolution":{"observed_at":"2026-08-12T04:41:55.205503Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12526","last_updated":"2023-08-24T03:30:38Z","snapshot_observed_at":"2026-08-13T10:28:38.115703Z","submitted_at":"2023-08-24T03:30:38Z","title":"UNISOUND System for VoxCeleb Speaker Recognition Challenge 2023","version":1},"cited_work":{"arxiv_id":"2308.12526","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.12526","snapshot_observed_at":"2026-08-12T04:41:55.177349Z","title":"UNISOUND System for VoxCeleb Speaker Recognition Challenge 2023","venue":"eess.AS","work_id":"2df52920-2819-4024-a5ad-4b0e03659d2d","year":2023},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.979489Z"},"links":{"cited_paper":"/paper/2308.12526","citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:4f7f194437b103084e06b54754130a76a512708652949d5ea513c9cb04616fd5","observation_id":"0c879338-9f80-4eed-b228-8abaa291feee","resolution":{"observed_at":"2026-08-12T04:41:55.182609Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.543154Z","title":"Learning representations by back-propagating errors,","venue":null,"work_id":"a5c376bf-8be5-4fa9-a466-7d47ff4ff138","year":1986},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.984329Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:7cada14a59d84cd1df78cc56f592011c70b24e6574b5c9b8942397f7bdbfb26e","observation_id":"6372ced0-43d4-47b2-b548-c814c5e3429d","resolution":{"observed_at":"2026-08-12T04:41:55.548429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:54.988884Z","title":"On the momentum term in gradient descent learning algo- rithms,","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.988884Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:2a3aeb32dfd7097cfbb77b10a98181f9354ebeb4047280c52122e12a83585059","observation_id":"e364951b-986b-4c57-be7f-407cfebda429","resolution":{"observed_at":"2026-08-12T04:41:54.988884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.516664Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":"758a0dca-7101-4778-a3c1-86a7faf5f015","year":2015},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.993885Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:88ce019f79793c34c0b79cee8f9c6d267f18270c844c70a12081aa63da8d0ed8","observation_id":"5a6221c9-77d3-4b26-84ca-331fe3d3da25","resolution":{"observed_at":"2026-08-12T04:41:55.521703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:54.998407Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:54.998407Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:bb92c7e8b3c13c116706b5cae17175867b2623f5f3eecf8ffef3bc40a776d795","observation_id":"02a3fa18-65f5-4094-b03c-69fe135ac293","resolution":{"observed_at":"2026-08-12T04:41:54.998407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.486854Z","title":"Tensorflow: A system for large-scale machine learning,","venue":null,"work_id":"c203036d-ae22-467d-b518-981cb4548ebd","year":2016},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.003042Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:7b2d429e81b9dc4c8c71172db5a6a7bff8ec1e1f5cf804ad8e5c8dbb6e321849","observation_id":"a00a94a5-ccbc-4f55-8a11-773a64130e6c","resolution":{"observed_at":"2026-08-12T04:41:55.492264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.469322Z","title":"Automatic differentiation in pytorch,","venue":null,"work_id":"3d7930bd-b452-4f2c-93d1-54bbcb149524","year":2017},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.007750Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:7697c3062500d0fda43118a840b443f36c92a25f1b36556a821ddc570324228a","observation_id":"135cc4e9-4694-48d6-b29d-e1559a4b7752","resolution":{"observed_at":"2026-08-12T04:41:55.475179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14123","last_updated":"2024-03-21T04:31:59Z","snapshot_observed_at":"2026-08-13T00:48:58.630081Z","submitted_at":"2024-03-21T04:31:59Z","title":"AI and Memory Wall","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14123","snapshot_observed_at":"2026-08-12T04:41:55.012279Z","title":"Ai and memory wall,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.012279Z"},"links":{"cited_paper":"/paper/2403.14123","citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:d030c8a27de51965506109115354c5128ad0ba6d523cba0932e00bae1c95aa38","observation_id":"2b22e623-2e3c-4738-ba77-8103054275d0","resolution":{"observed_at":"2026-08-12T04:41:55.012279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.450581Z","title":"Reversible neural networks for memory-efficient speaker verification,","venue":null,"work_id":"49a7f875-5e61-4167-9234-c7d373840087","year":2023},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.017151Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:1e6e5c8620f3d97c6886340939eaf56c50f971c1f5c1c22a813aba23a302a7f8","observation_id":"d9fa9a0e-03de-4911-9628-e419d8695d1a","resolution":{"observed_at":"2026-08-12T04:41:55.456483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.432039Z","title":"Compiling machine learning programs via high-level tracing,","venue":null,"work_id":"0cf0e4f3-0b07-4205-a668-f2e43543f850","year":2018},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.021702Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:b7425db771925aadca551dc939a886e3eb18ebc34fc4ecd368e447b77a8dbcf7","observation_id":"0178f7ae-3369-49fb-83f3-def8dc791c77","resolution":{"observed_at":"2026-08-12T04:41:55.438237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.411342Z","title":"The reversible residual network: Backpropagation without storing activations,","venue":null,"work_id":"c65d8333-5a9f-444f-8143-188fd2430331","year":2017},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.026116Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:9c05e4aae06a7cd59658be4a063ddaf0f7885a068361445ccfa8c53a4ba0f0ac","observation_id":"a9e7a823-55b9-4116-8c1d-33efa86a986a","resolution":{"observed_at":"2026-08-12T04:41:55.418227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.383315Z","title":"8-bit approximations for parallelism in deep learning,","venue":null,"work_id":"a38a7fb6-f127-4b2c-8024-6b1c4a38fb01","year":2016},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.030757Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:417b16bde8d8f1d773bf56972b80c0afe12ab57137135f56eb62a6df1b82daf0","observation_id":"e8c35e1f-5faa-4422-b7f9-f218d7c5a806","resolution":{"observed_at":"2026-08-12T04:41:55.391960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.364984Z","title":"V oxceleb: A large-scale speaker identification dataset,","venue":null,"work_id":"7bcc280c-5f1f-4437-a98c-8c428d36113a","year":2017},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.035506Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:a65e4ba1bbfa46d7b09169d38ae91b4759feb2ed8a11534e59389785b38e8184","observation_id":"e030be80-92f0-48a6-bd41-4760eec92251","resolution":{"observed_at":"2026-08-12T04:41:55.370605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.040151Z","title":"V oxceleb2: Deep speaker recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.040151Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:91544d7d8b69cab5d6e8402a46f5a42152b5b89d6014a34a59b383b20153d4a6","observation_id":"258b9362-4d32-4153-966e-65795490d930","resolution":{"observed_at":"2026-08-12T04:41:55.040151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.12731","last_updated":"2020-10-24T01:16:59Z","snapshot_observed_at":"2026-07-06T10:08:04.948412Z","submitted_at":"2020-10-24T01:16:59Z","title":"The DKU-DukeECE Systems for VoxCeleb Speaker Recognition Challenge 2020","version":1},"cited_work":{"arxiv_id":"2010.12731","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.12731","snapshot_observed_at":"2026-08-12T04:41:55.135042Z","title":"The DKU-DukeECE Systems for VoxCeleb Speaker Recognition Challenge 2020","venue":"eess.AS","work_id":"a5f246df-109c-4911-bcd2-6b9f11621eed","year":2020},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.044931Z"},"links":{"cited_paper":"/paper/2010.12731","citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:9d6359753afaa99acefb54c27a42ccf91a2826af56d9d2e63cf11ad5267183d6","observation_id":"edd01b68-c139-49b9-bd5f-eae4ca28f959","resolution":{"observed_at":"2026-08-12T04:41:55.142767Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.330066Z","title":"On-the-fly data loader and utterance-level aggregation for speaker and language recognition,","venue":null,"work_id":"11edc9b4-b61c-4383-a487-47e0353c272a","year":2020},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.050416Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:555ea1780bae1b9b08f5038cd57312974bd986aaa5f688938e63019a46f76074","observation_id":"e888337e-4355-44ad-9794-afeebdfddf1a","resolution":{"observed_at":"2026-08-12T04:41:55.336714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1510.08484","last_updated":"2015-10-28T20:59:04Z","snapshot_observed_at":"2026-07-06T04:34:36.474437Z","submitted_at":"2015-10-28T20:59:04Z","title":"MUSAN: A Music, Speech, and Noise Corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.08484","snapshot_observed_at":"2026-08-12T04:41:55.057047Z","title":"Musan: a music, speech, and noise corpus,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.057047Z"},"links":{"cited_paper":"/paper/1510.08484","citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:d9e76c64916200f35258d80b1a0b3c70279bea546f94521265fbafd148f8b272","observation_id":"313b3e6d-bac0-40a0-a6fc-af2672c8b84a","resolution":{"observed_at":"2026-08-12T04:41:55.057047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.312815Z","title":"A study on data augmentation of reverberant speech for robust speech recognition,","venue":null,"work_id":"425ad7e4-2720-4064-9d7e-87bbd1f6cbd9","year":2017},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.062305Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:48dd7c3d243d5c6143e529d08761557487b3d33fa57ac03a59589fb35682d793","observation_id":"e57c9195-4fb7-4890-9b68-a68a43ac7dff","resolution":{"observed_at":"2026-08-12T04:41:55.318318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.652995Z","title":"Large margin softmax loss for speaker verification,","venue":null,"work_id":"502fb074-119f-4f64-a8d9-31d608d008e3","year":2019},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.067281Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:7111ba1c7c2ed7e67d16ef551b5ff7f0dcb31eab66c58594dd1cd6d2078c7185","observation_id":"796f8a97-a271-4577-9385-a9793818b9ff","resolution":{"observed_at":"2026-08-12T04:41:55.658088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:41:55.293473Z","title":"Towards reduced false- alarms using cohorts,","venue":null,"work_id":"e8d1c2a5-0265-44f4-b294-050d1b80f0e3","year":2011},"citing_paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T04:41:55.073891Z"},"links":{"citing_paper":"/paper/2412.01195"},"observation_digest":"sha256:f9ad0e5238178beefbe4f39640809466ad5250122a37d1aacd4fd09f5f23cdd5","observation_id":"106fc526-60a1-43a8-91ea-003a1ee94b85","resolution":{"observed_at":"2026-08-12T04:41:55.299240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.01195","last_updated":"2024-12-02T06:57:46Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-12T04:33:18.559842Z","submitted_at":"2024-12-02T06:57:46Z","title":"Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":5,"verified_fuzzy":38},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2412.01195."}