{"as_of":"2026-08-08T04:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:05afc298f760dfe9729f430b35e7c29ae14574698595ac4209864e4c4c2518fb","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:28:30.049480Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.21805/citation-record","integrity":"/paper/2505.21805/integrity","json":"/paper/2505.21805/citation-record.json","paper":"/paper/2505.21805"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:34.707973Z","title":null,"venue":null,"work_id":"8fd290e3-dddf-4e48-9e34-31c268cda449","year":null},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:27.958814Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:058d9eb6a8fcb7af115c06b8d29b1affa2de1e29b87f5ca1ded7d1f411ae6db6","observation_id":"39ebed00-c6c3-4b32-a83d-2850224a9cf3","resolution":{"observed_at":"2026-08-07T13:28:34.750422Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:34.607213Z","title":"hard samples","venue":null,"work_id":"7765f94a-0144-4c6d-ac9b-8f85c5d6ddfb","year":null},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:28.002672Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:655a8c9b47bd6341cc7b8bd5555d1ee46031a092a02055ca41da6a1dd3324919","observation_id":"c0d397eb-4f83-44cf-a0cb-9d19d3646e0d","resolution":{"observed_at":"2026-08-07T13:28:34.642899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:34.475521Z","title":"Speaker Augmentation 3.1.1","venue":null,"work_id":"54f30a41-0668-4a53-a417-734280208d66","year":null},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:28.065399Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:c54842ec2ff160b5a30a12372ac96ed787c0c8db85d7cd864af245d8991fa094","observation_id":"8c22692c-f2a8-4674-a0b9-35fad6967aad","resolution":{"observed_at":"2026-08-07T13:28:34.543048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:34.393940Z","title":"Experimental Setup 4.1.1","venue":null,"work_id":"270c0618-4b26-402e-a37e-ea8e1d2472e7","year":null},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:28.118118Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:cae95f3e202e096fb5b0271e509edebffc4773f08b39daee3a5b64be222bf605","observation_id":"310e2597-11b2-4753-986b-0b2c3ffc62f3","resolution":{"observed_at":"2026-08-07T13:28:34.436655Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:34.271625Z","title":"By applying a resampling-and-rescaling pipeline, we can gene rate vast pseudo-speakers, enriching speaker diversity in the t rain- ing data","venue":null,"work_id":"ebe6a473-6d01-44d3-b3a9-43bf4698c0cc","year":null},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:28.164237Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:a81cfa99c761df2b78bcf829a902ad717da14476901d08848793154567fe5497","observation_id":"004f5c53-a42f-4b54-a48a-41e0f7493eb6","resolution":{"observed_at":"2026-08-07T13:28:34.302961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:34.197855Z","title":"Spex: Multi-scale tim e domain speaker extraction network,","venue":null,"work_id":"fab079be-7969-461c-b4c1-676f37fc8c6b","year":2020},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:28.229719Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:ac0961fd79cda36fdfe0721c2948e8acce741c25200c4c12ce97a3bf9866d510","observation_id":"9d57ed13-d009-412f-bd26-28551622ade1","resolution":{"observed_at":"2026-08-07T13:28:34.222586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.00733","last_updated":"2023-09-15T06:15:22Z","snapshot_observed_at":"2026-08-04T02:51:19.469927Z","submitted_at":"2022-02-01T20:10:23Z","title":"New Insights on Target Speaker Extraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.00733","snapshot_observed_at":"2026-08-07T13:28:28.280103Z","title":"New insights on target speaker extraction,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:28.280103Z"},"links":{"cited_paper":"/paper/2202.00733","citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:124fa58bc41ef4ae47317f2b821a30df96acd602e3e7ff5329f04a2315b41b6e","observation_id":"b27deef6-171e-406a-a9ff-f981e0bd05c4","resolution":{"observed_at":"2026-08-07T13:28:28.280103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:34.059237Z","title":"Neural target speech extraction: An overview,","venue":null,"work_id":"cde215f5-0d7f-45d0-a6f6-78d149d6b6d4","year":2023},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:28.358757Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:dd18850d822cc82cbb599abb1c87d87eaa7b713109c315e6ece18640db208f9f","observation_id":"d834e821-1317-49d1-87a1-2535170d2ea8","resolution":{"observed_at":"2026-08-07T13:28:34.151690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:33.985214Z","title":"Blind so urce separation and independent component analysis: A review,","venue":null,"work_id":"99ac983d-a907-4bce-b8f1-750b5403781d","year":2005},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:28.419215Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:8ae30fb8b75cfae099de916d9176077e8fbadf8c3fc486e182532ce4205f55f7","observation_id":"8d6d1485-bea0-4738-be9a-3de763c515b8","resolution":{"observed_at":"2026-08-07T13:28:34.017717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:33.907739Z","title":"Blind source separation,","venue":null,"work_id":"cecb9b6c-bd42-49a7-babc-5e146a28c3b7","year":2014},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:28.489423Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:93992950e900619042bcbe7d9ccd55addef43f3d10cdc7c55e28466632c065ab","observation_id":"86eae636-9027-44e3-b5bb-afee520fe0c2","resolution":{"observed_at":"2026-08-07T13:28:33.946829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:33.782750Z","title":"Blind source sep - aration: A review and analysis,","venue":null,"work_id":"541b3e91-752b-4b57-9a86-fc4e1a7cca56","year":2013},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:28.582292Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:a3d6e164290846b81222cda86458005a955437853d0c023dd59ff7232cb9152b","observation_id":"ba8e56ae-ff18-41d9-9596-8500d940129f","resolution":{"observed_at":"2026-08-07T13:28:33.821831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:33.662836Z","title":"Improving speaker discriminati on of target speech extraction with time-domain speakerbeam,","venue":null,"work_id":"5c3330cc-f290-471d-958b-b843bed870eb","year":2020},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:28.626436Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:e121912e1822c5a2deeede9452743f7f5435fdf6856a001306b0ccb26b06b11a","observation_id":"eb4abb92-d948-4056-a532-b96a537e34af","resolution":{"observed_at":"2026-08-07T13:28:33.707399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:33.551161Z","title":"X-SepFormer: End-to-e nd speaker extraction network with explicit optimization on s peaker confusion,","venue":null,"work_id":"a5af6972-bbb3-451d-9e74-7537c0d7be6d","year":2023},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:28.701590Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:7cb73b7d47716f5cd8a6a895934b7c78a5b14dcd297a346958d83621a443a5f2","observation_id":"af61a6a7-0bbb-435a-ad88-e599d292f497","resolution":{"observed_at":"2026-08-07T13:28:33.607898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:33.434176Z","title":"MC-SpEx: Towards effective speaker extraction with multi-scale interfusion and conditional speaker modulati on,","venue":null,"work_id":"d6771e1f-0d0b-4b76-9eab-18e40b744506","year":2023},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:28.794100Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:8af64ec3e9724a8a1c02930a2f68778dd828ff7ffc2e903c01903b3a846d8726","observation_id":"235ca92b-9830-481b-ab27-3e0f892b908a","resolution":{"observed_at":"2026-08-07T13:28:33.497627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:33.294249Z","title":"Target confusion in end-to-end speaker extraction: Analysis and approaches ,","venue":null,"work_id":"60821454-6ebd-4140-aa01-bc0e1d1f5405","year":2022},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:28.856000Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:b00ee69dea2445435cd5a3bb88ae60e3cd4360275566d1f4bf470327ea7c8615","observation_id":"2a00e7ec-b8bc-4ae0-b3e2-30bb6ffc4ebd","resolution":{"observed_at":"2026-08-07T13:28:33.387163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:33.141364Z","title":"A hybrid continuity loss to redu ce over-suppression for time-domain target speaker extracti on,","venue":null,"work_id":"f7c54993-65d2-4c85-84fb-9f252201e3b0","year":2022},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:28.926738Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:906dfe9a8e5260269a556edbf3c7dfacc0107447bc249a2b1f61df5ed6199174","observation_id":"d8657cfc-a2d0-4a92-8dea-0cd66c847693","resolution":{"observed_at":"2026-08-07T13:28:33.180617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:32.997149Z","title":"On the effectiveness of enrollment speech augmentation fo r tar- get speaker extraction,","venue":null,"work_id":"e38284cd-2b33-48f7-a4d5-13fa755604a3","year":2024},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:28.976124Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:be3841f71eb5cecb5436a44eb1ee0431511fde3135a68fe21ff2e0040f8603a3","observation_id":"6c311c33-81f5-4edd-97c0-1cbc3f071a05","resolution":{"observed_at":"2026-08-07T13:28:33.068083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:32.813439Z","title":"Multi - stage speaker extraction with utterance and frame-level re ference signals,","venue":null,"work_id":"f2b677e5-4217-4edc-9ff0-2c9231e96245","year":2021},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:29.047507Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:bdc368cd22789058894d4f6712ac51fa4eb43cead735a5ae0a15159475d33f3a","observation_id":"fa1d7184-fdbf-41d8-9d5c-31d406200868","resolution":{"observed_at":"2026-08-07T13:28:32.895190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:32.630980Z","title":"Robust speaker extraction network based on iterativ e re- ﬁned adaptation,","venue":null,"work_id":"afa93787-a547-4f91-a4bb-f9ed92ab2183","year":2021},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:29.127479Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:e9cac0ac92a823163ef6804d8fa5fe24fb51bcec7b599056e31d19ad70ba8219","observation_id":"35fda90a-8243-4a23-a4d8-61e3dfd85156","resolution":{"observed_at":"2026-08-07T13:28:32.730804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:32.504085Z","title":"Spea ker augmentation and bandwidth extension for deep speaker embe d- ding","venue":null,"work_id":"72312e2c-8939-4e6e-85bd-cc19b26a61b5","year":2019},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:29.204754Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:d764d875992a49a13eb3c181ed0f384d2cc59487eac9811101af1d9d51cf4e1c","observation_id":"a6123f1e-117c-435c-a192-80b29b9122a4","resolution":{"observed_at":"2026-08-07T13:28:32.565496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:32.315218Z","title":"B uild a SRE challenge system: Lessons from V oxSRC 2022 and CN- SRC 2022,","venue":null,"work_id":"850eb8bd-d097-42b9-9a5a-fe7006459c42","year":2022},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:29.272825Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:47520c5983d21fe16cc43e4cbc448ad0a0669f6402f631c15674570d5f7e23a2","observation_id":"b5fc79a1-0cb9-4f67-9f53-8448c2367174","resolution":{"observed_at":"2026-08-07T13:28:32.424020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:32.162205Z","title":"A comprehensiv e investigation on speaker augmentation for speaker recogni tion,","venue":null,"work_id":"9048401d-4721-4d49-89d7-067037077397","year":2024},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:29.319812Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:95c12b312885b9c8b30fe43ebf3efb717e54698b8252b08deb32b0fbd5ef1c2a","observation_id":"f0f08a3a-ca79-4a03-980d-a9810a34a2c7","resolution":{"observed_at":"2026-08-07T13:28:32.219227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:32.004576Z","title":"Deep clus- tering: Discriminative embeddings for segmentation and se para- tion,","venue":null,"work_id":"45b5dbfb-dfb3-4feb-87a0-d1a5eee647ee","year":2016},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:29.413192Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:8b5b43f28972cf83b47f7975310c72c4856f85cd7bd49250b4f6dade5e800de4","observation_id":"97db1f78-63f0-4a23-afa4-a2f45c45eadb","resolution":{"observed_at":"2026-08-07T13:28:32.069301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.11262","last_updated":"2020-05-22T16:26:54Z","snapshot_observed_at":"2026-08-04T10:15:33.124350Z","submitted_at":"2020-05-22T16:26:54Z","title":"LibriMix: An Open-Source Dataset for Generalizable Speech Separation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.11262","snapshot_observed_at":"2026-08-07T13:28:29.445402Z","title":"Librimix: An open-source dataset for generalizable speech separation,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:29.445402Z"},"links":{"cited_paper":"/paper/2005.11262","citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:e8af2264ac9625ab14bd952b8b35c1f3b91e574a73142de933a548dbb3396172","observation_id":"62add7c9-64bb-4ba3-98ad-d7324cb2cdc9","resolution":{"observed_at":"2026-08-07T13:28:29.445402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:31.802145Z","title":"Dual-path RNN: efﬁcie nt long sequence modeling for time-domain single-channel speech s epa- ration,","venue":null,"work_id":"4fcd33aa-97e2-4127-b6e3-9b640af697c9","year":2020},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:29.481387Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:b95852e15898db246689f4eb1e13a605654f984a696dd06b4ed6096e5118a612","observation_id":"8b67726b-677f-4782-a197-51a4aa8f0836","resolution":{"observed_at":"2026-08-07T13:28:31.875787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:31.582945Z","title":"Spex+ : A complete time domain speaker extraction network,","venue":null,"work_id":"5a5b0ca8-3903-485f-ae49-654659e5a35f","year":2020},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:29.552880Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:6c0f370ac51e3ae6bcaf0f22b30f275c46bc58e025d6f9654bba65a509d33b6a","observation_id":"a69bd6e7-6e3e-4937-a927-c405bc466911","resolution":{"observed_at":"2026-08-07T13:28:31.670558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:31.440043Z","title":"Speakeraug- ment: Data augmentation for generalizable source separati on via speaker parameter manipulation,","venue":null,"work_id":"9e959737-96f5-46d0-aefd-8765465b640a","year":2023},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:29.627068Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:069303196134fbec8178be921ca386374c14fa810c826bd52dd8c6d493261791","observation_id":"ce546e12-a556-40b7-9c29-fb6946103820","resolution":{"observed_at":"2026-08-07T13:28:31.495566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:31.306003Z","title":"An overlap-add technique based on waveform similarity (WSOLA) for high quality time-scale mo d- iﬁcation of speech,","venue":null,"work_id":"0a10cd60-aa67-4c51-a53b-f8d859d41c03","year":1993},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:29.703337Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:2fa10d35878d4af9ba80de68c1767156eb0d9897a89eef9223f27d481ee57d06","observation_id":"8e908ee2-ebc6-4ec4-8a53-1f4d107aad8b","resolution":{"observed_at":"2026-08-07T13:28:31.366647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:31.138282Z","title":"CSR- I (WSJ0) Complete LDC93S6A,","venue":null,"work_id":"4a23f5bc-46c4-4430-969a-2f0f808f0f40","year":1993},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:29.736789Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:a9530858fefc40cf49d0fd42775d27937f59d9fddfefa54435bddb505b7bc37e","observation_id":"c006f96a-5546-4ec2-a2fb-2043685d5e1d","resolution":{"observed_at":"2026-08-07T13:28:31.196216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:31.018208Z","title":"Lib- rispeech: an ASR corpus based on public domain audio books,","venue":null,"work_id":"ca1086b3-c595-40f3-80d8-73eb92657f79","year":2015},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:29.808030Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:18cfce06c11f576849d5adfd175c999a2e884292b1d1a36e699032a90a194296","observation_id":"66aecfb1-179e-429a-8d26-340617192ebd","resolution":{"observed_at":"2026-08-07T13:28:31.075936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:30.796173Z","title":"Wham!: Extending speech separation to noisy environments,","venue":null,"work_id":"012d9f8c-737f-4ed6-ab49-59f44c7473f8","year":2019},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:29.869166Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:e7d72e56e128eaaac62d27217b596461c776e31f747705a1ad28ac0a6e2e0aa9","observation_id":"1d23989c-5203-4c83-8d91-819e3f3775bc","resolution":{"observed_at":"2026-08-07T13:28:30.887559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:30.671635Z","title":"Asteroid: the PyTorch-based audio source separa- tion toolkit for researchers,","venue":null,"work_id":"450c1dba-7c55-48af-b620-99d42bb30dd6","year":2020},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:29.916671Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:09316f0d11101ac1fda8f5f9d1c75de6f5913c60067bf1f0bdb81b6620d9bd98","observation_id":"9b5d70af-d944-4256-9a31-e7a382365a84","resolution":{"observed_at":"2026-08-07T13:28:30.726115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:30.514484Z","title":"TaSNet: Time-domain audio sep ara- tion network for real-time, single-channel speech separat ion,","venue":null,"work_id":"a0fd7477-2937-4994-a32f-44696bedf13d","year":2018},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:29.962267Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:7f9d7eefce2e769d38c2b7e05d7679fbb8de55afbc4bb4405390f5702a71c0ba","observation_id":"3c19327b-241d-4458-afd5-89e3197aa1d5","resolution":{"observed_at":"2026-08-07T13:28:30.617935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:30.364123Z","title":"Data au gmen- tation for speech separation,","venue":null,"work_id":"79e3d3a7-7665-4450-bd88-31d95ede47bb","year":2023},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:30.005371Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:7f80c69983a0eb597ac51096e822aa592df3cf0a1d42994033fd38dfa2f0f3e9","observation_id":"f353a6cb-c0c1-4696-a9db-7547367f1b31","resolution":{"observed_at":"2026-08-07T13:28:30.423447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:28:30.186195Z","title":"X-TaSNet: Robust and accu rate time-domain speaker extraction network,","venue":null,"work_id":"48091f03-ac5b-4546-be47-06cff9c42c91","year":2020},"citing_paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:30.049480Z"},"links":{"citing_paper":"/paper/2505.21805"},"observation_digest":"sha256:c635054a6f541772c810f10c2f7fb85c102958ffeed0269f87868aafdfda0f54","observation_id":"78dbd99a-2251-4021-aa62-fdd81109c229","resolution":{"observed_at":"2026-08-07T13:28:30.269326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.21805","last_updated":"2025-05-27T22:21:58Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T13:20:35.004869Z","submitted_at":"2025-05-27T22:21:58Z","title":"An Investigation on Speaker Augmentation for End-to-End Speaker Extraction"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":0,"verified_fuzzy":31},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2505.21805."}