{"as_of":"2026-08-08T23:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1cca18e7e0571c5f3b0c7ce6f7c2860c67e36772a495f4eab562fc079acb420e","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T18:29:41.653077Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.09932/citation-record","integrity":"/paper/2509.09932/integrity","json":"/paper/2509.09932/citation-record.json","paper":"/paper/2509.09932"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:39.492161Z","title":"Front- end factor analysis for speaker verification,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:39.492161Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:79097bb4538858043fd51325edb48c0b04c7780a58b25a3f8fca8fbd87f1f9fe","observation_id":"d6d3d452-9bbe-4763-9754-dd92033584b0","resolution":{"observed_at":"2026-08-04T18:29:39.492161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:39.544721Z","title":"Unsupervised speaker adaptation based on the cosine similarity for text-independent speaker verification","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:39.544721Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:3e68ca8722df58ca38cf4c9d6ab303d039cca2cc65307b05ac41b0d99db036ef","observation_id":"63ba7234-cfeb-47f8-b922-37007cd4b268","resolution":{"observed_at":"2026-08-04T18:29:39.544721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:39.589579Z","title":"Probabilistic linear discriminant analysis,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:39.589579Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:db845881ab1c9dff6b16e48b6b57a42b76b02f761f26e0350fee78970afdecb3","observation_id":"6a6e3dea-1dc9-48d5-b307-44cfaa38912d","resolution":{"observed_at":"2026-08-04T18:29:39.589579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:39.669890Z","title":"X- vectors: robust DNN embeddings for speaker recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:39.669890Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:29d0223c383b36a6d9d2294477c86ffd7f51a80cad2b24c8886c72deeb0a1aaa","observation_id":"8665c159-c6a6-443b-a2fc-46b411f155b5","resolution":{"observed_at":"2026-08-04T18:29:39.669890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:39.771133Z","title":"Speaker recognition for multi-speaker conversations using x-vectors,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:39.771133Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:0e715e456c478a1ee95279a6c41f62c471260570422b919a588a7b266fcf1ae8","observation_id":"4b53a3e3-13ec-45c7-8cfa-a8ed9a372233","resolution":{"observed_at":"2026-08-04T18:29:39.771133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:39.863814Z","title":"A time delay neural net- work architecture for efficient modeling of long temporal contexts,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:39.863814Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:829ba74750a60f956507b079b9436c29a5c0ad8a4dacdf8d36cd80b413219c10","observation_id":"3a77ee79-50cc-4ef3-b5ee-2f33f51f5ef6","resolution":{"observed_at":"2026-08-04T18:29:39.863814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:39.944319Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:39.944319Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:6823160e1c3558d0e55f55bf86b8db058b97087912b43afd99e9098e4bffd63a","observation_id":"8901f83c-d7b4-4998-9b71-af33e5dd3dc8","resolution":{"observed_at":"2026-08-04T18:29:39.944319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.026239Z","title":"Deep speaker embedding extraction with channel-wise feature responses and additive supervision softmax loss function,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.026239Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:c611b7f06b066dddb493bf20de45c91abe6bdf2c239eaefa0a68e6bd7a1ef104","observation_id":"8f7b6053-79e0-416b-af8e-804604c26770","resolution":{"observed_at":"2026-08-04T18:29:40.026239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.082299Z","title":"Squeeze-and-excitation networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.082299Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:fb0440e058a4ce4b5e6216697ca81667c664ce477113ec75b0cdab4b11746a53","observation_id":"e5dcc0e0-506b-4610-aa71-3bfedce6a715","resolution":{"observed_at":"2026-08-04T18:29:40.082299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.138295Z","title":"ECAPA-TDNN: emphasized channel attention, propagation and aggregation in TDNN based speaker verification,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.138295Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:7194d9427430cb744386c16c476e30a73c9ac8523d37f9cffbdf80f33459bd72","observation_id":"e9703e86-4a2e-4861-bae4-470deb5b6057","resolution":{"observed_at":"2026-08-04T18:29:40.138295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.214762Z","title":"Res2net: a new multi-scale backbone architecture,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.214762Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:f10edf2bdf82a06e2e2d5863a2b5ebdb71ec6dbf74db8c3d08b244cb94a43aca","observation_id":"3f1d29ef-ae3c-462c-895c-f1ee65bb0be2","resolution":{"observed_at":"2026-08-04T18:29:40.214762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.272617Z","title":"Branch-ECAPA- TDNN: a parallel branch architecture to capture local and global features for speaker verification,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.272617Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:57ff2ed894c7d6edfcbef41a1be010b8b57b94815cc6a5e247652cbde4fdfb15","observation_id":"a89059b5-12f0-4e45-8565-9789ca8ab6ea","resolution":{"observed_at":"2026-08-04T18:29:40.272617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11020","last_updated":"2023-08-01T07:09:50Z","snapshot_observed_at":"2026-07-06T15:05:38.707313Z","submitted_at":"2023-03-20T10:58:12Z","title":"DS-TDNN: Dual-stream Time-delay Neural Network with Global-aware Filter for Speaker Verification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11020","snapshot_observed_at":"2026-08-04T18:29:40.350753Z","title":"Dual-stream time-delay neural network with dynamic global filter for speaker verification,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.350753Z"},"links":{"cited_paper":"/paper/2303.11020","citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:a5a3b5d1922ffab07d753cd00ae589ca19ad46f528cf9bce5445a9ab24bb46a4","observation_id":"fde410a4-ff5c-4b4a-bb64-defc324417cb","resolution":{"observed_at":"2026-08-04T18:29:40.350753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.433029Z","title":"PCF: ECAPA-TDNN with progressive channel fusion for speaker verification,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.433029Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:e0977acaaa6a655061b9db04d9d6f0cbc53aacb1b249052aec559e1daa53f682","observation_id":"4e8a0e25-5511-49a2-94a4-9e60853a4b1a","resolution":{"observed_at":"2026-08-04T18:29:40.433029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.517504Z","title":"ECAPA++: fine-grained deep embedding learning for TDNN based speaker verification,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.517504Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:1ca024dc320fbd5bca3a83afa67723006c45cac451ffc7cbe61e6dabc3f7add5","observation_id":"7c1a1037-9d1d-45d5-9507-d69975399b0c","resolution":{"observed_at":"2026-08-04T18:29:40.517504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.602482Z","title":"PhaseDCN: a phase-enhanced dual-path dilated convolutional network for single- channel speech enhancement,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.602482Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:1bef38ddbe99fff52f99a340502b574361776f2c2cab9c1bd7ee8ef6497d768f","observation_id":"f7a29ffb-79c3-46d4-a6d3-0e9e3c1cb8c5","resolution":{"observed_at":"2026-08-04T18:29:40.602482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.653948Z","title":"V oxCeleb: a large-scale speaker identification dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.653948Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:8188627c2f718d37ce988ddfae394e6611ca74f1721e59151c9850f967914f7d","observation_id":"db91d461-3330-439a-95ae-ed0c97b9d61b","resolution":{"observed_at":"2026-08-04T18:29:40.653948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.714959Z","title":"V oxCeleb: large- scale speaker verification in the wild,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.714959Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:a6b460a7c7208c5c41816134ed92e4c078fb7fb4b82cd80f92de4777a561f1fd","observation_id":"d36ef299-7540-4d61-899a-c59792f4a884","resolution":{"observed_at":"2026-08-04T18:29:40.714959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.05622","last_updated":"2018-06-27T01:49:17Z","snapshot_observed_at":"2026-08-08T04:36:13.309903Z","submitted_at":"2018-06-14T15:59:12Z","title":"VoxCeleb2: Deep Speaker Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.05622","snapshot_observed_at":"2026-08-04T18:29:40.790511Z","title":"V oxceleb2: deep speaker recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.790511Z"},"links":{"cited_paper":"/paper/1806.05622","citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:7ac689e46d8fea2ae22f9ac063491d9b6312990a5ef749c9a7037e6079765237","observation_id":"bd0ee946-5adc-43d4-ba5b-648309e83642","resolution":{"observed_at":"2026-08-04T18:29:40.790511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.895476Z","title":"CN-Celeb: a challenging chinese speaker recog- nition dataset,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.895476Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:96f452b2a7fc225f2798057f2fa18293a700a4115edc62b3579395f733264051","observation_id":"ad15ad06-6042-4b90-ba77-417988e0dbb7","resolution":{"observed_at":"2026-08-04T18:29:40.895476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.948461Z","title":"CN-Celeb: multi-genre speaker recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.948461Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:dd09e5dc5e072913d4abab9a5521a1f66ee309b22ab3a364677ec86bd1aaf865","observation_id":"30f44b7e-eabe-4992-b50c-37da4d4c1a2c","resolution":{"observed_at":"2026-08-04T18:29:40.948461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1510.08484","last_updated":"2015-10-28T20:59:04Z","snapshot_observed_at":"2026-07-06T04:34:36.474437Z","submitted_at":"2015-10-28T20:59:04Z","title":"MUSAN: A Music, Speech, and Noise Corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.08484","snapshot_observed_at":"2026-08-04T18:29:41.001035Z","title":"Musan: a music, speech, and noise corpus,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:41.001035Z"},"links":{"cited_paper":"/paper/1510.08484","citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:0e6afef9afed4aaeed52c8dfe853ee2347a5122ce0bb1918daf6ea3a0b55746b","observation_id":"021b3e74-e6de-4648-8514-55c41cb83777","resolution":{"observed_at":"2026-08-04T18:29:41.001035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:41.083220Z","title":"A study on data augmentation of reverberant speech for robust speech recognition,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:41.083220Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:18d635e44989df867836aa28db0bf142ccd19e0d6ed5ed39768805ac1e022af7","observation_id":"3c3623f2-7185-4714-80a3-83800aaeb397","resolution":{"observed_at":"2026-08-04T18:29:41.083220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08779","last_updated":"2019-12-03T18:19:07Z","snapshot_observed_at":"2026-08-04T08:35:21.943076Z","submitted_at":"2019-04-18T17:53:38Z","title":"SpecAugment: A Simple Data Augmentation Method for Automatic Speech Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08779","snapshot_observed_at":"2026-08-04T18:29:41.136871Z","title":"Specaugment: a simple data augmentation method for automatic speech recognition,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:41.136871Z"},"links":{"cited_paper":"/paper/1904.08779","citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:b282c583478381ae73b46970327428fcb74567753e4f2052e12265f8b14bee00","observation_id":"50e7e4b4-82cd-4515-bdde-58683159c110","resolution":{"observed_at":"2026-08-04T18:29:41.136871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:41.248655Z","title":"Arcface: additive angular margin loss for deep face recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:41.248655Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:6c3b7eb4d94a1ef61b7de4db307b47ccd0a0f7a1f285cedd7a6c23c6484d5a08","observation_id":"e9f94205-1f78-4997-9cd2-1700ae3c4922","resolution":{"observed_at":"2026-08-04T18:29:41.248655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:41.333015Z","title":"Margin matters: to- wards more discriminative deep neural network embeddings for speaker recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:41.333015Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:dd5bdd80e1ca89295e9ab3b3883712cc4c26a232df32d6e97503a85f7da875d1","observation_id":"815fab33-ae83-42f1-9158-f1671ee133be","resolution":{"observed_at":"2026-08-04T18:29:41.333015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-04T18:29:41.404254Z","title":"Adam: a method for stochastic optimization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:41.404254Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:363c238aaa3a8c6045923cfba83568c85d0e159e920f29d9e4edf67ecaf4f574","observation_id":"2a7f8947-b81e-4007-8ac4-a6350212779d","resolution":{"observed_at":"2026-08-04T18:29:41.404254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:41.489308Z","title":"Cyclical learning rates for training neural networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:41.489308Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:a475714692516323acc52b33aac3f4059aea0490e4bfa8119bbe113db8ce6037","observation_id":"d879a90a-5f53-43a5-b4fa-0aed6bbe05fe","resolution":{"observed_at":"2026-08-04T18:29:41.489308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:41.574801Z","title":"Duality temporal-channel-frequency attention enhanced speaker representation learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:41.574801Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:84a60800245563ec37cb8964a8fb8db15f734d4d0c65988e68d3bd1996b9276f","observation_id":"f24ddda2-fe02-4540-8d53-bcb704aa0e5b","resolution":{"observed_at":"2026-08-04T18:29:41.574801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00332","last_updated":"2023-06-16T09:07:11Z","snapshot_observed_at":"2026-08-05T18:44:00.793642Z","submitted_at":"2023-03-01T08:50:31Z","title":"CAM++: A Fast and Efficient Network for Speaker Verification Using Context-Aware Masking","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00332","snapshot_observed_at":"2026-08-04T18:29:41.653077Z","title":"CAM++: a fast and efficient network for speaker verification using context-aware masking,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:41.653077Z"},"links":{"cited_paper":"/paper/2303.00332","citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:3dd42251e81ab12682c6f46ef2211b6f3f71a18922b0d7853d61d5fea2d7b07a","observation_id":"81c03d8f-5cba-4908-9af8-282172876454","resolution":{"observed_at":"2026-08-04T18:29:41.653077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-08T06:19:00.224743Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2509.09932."}