{"as_of":"2026-08-13T05:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:78188c799ce22f6b9656379eb944b3c5cbd48f2663330fc7ca685f179581ddb9","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:12:18.083831Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.18497/citation-record","integrity":"/paper/2411.18497/integrity","json":"/paper/2411.18497/citation-record.json","paper":"/paper/2411.18497"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.700344Z","title":"Automatic speech recognition in cocktail-party situations: A specific training for separated speech,","venue":null,"work_id":"02d60211-0d8a-41dc-a5d4-b9b99965eda5","year":2012},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.948669Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:06cfb8c365aef9b2a831bdf99954c108dab669d5ff092905ea011800332b030b","observation_id":"38fda7ad-19d4-4639-8193-ff8b811a1f4e","resolution":{"observed_at":"2026-08-12T11:12:18.704556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.690007Z","title":"Espnet-se: End- to-end speech enhancement and separation toolkit designed for asr integration,","venue":null,"work_id":"29d1080c-3593-4827-86df-d008bac842fe","year":2021},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.952938Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:cca7a2e8ac99a6758881afcac4269ee6331ea1deed11e369d1ec549c578f90ed","observation_id":"51858476-056c-4b51-bdf7-16c01e7d2a00","resolution":{"observed_at":"2026-08-12T11:12:18.693559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.678869Z","title":"All-neural online source separation, counting, and diarization for meeting analysis,","venue":null,"work_id":"204a3aa5-c97f-490b-a590-9f5e77966ecd","year":2019},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.956441Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:a11d0ea6fcaea999544c38de819305c1085cc8f61873c9e3c954c8286a818f10","observation_id":"310eac9c-04b5-403b-9abb-1d41e41bc6f0","resolution":{"observed_at":"2026-08-12T11:12:18.682636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.666782Z","title":"Ts-sep: Joint diarization and separation conditioned on estimated speaker embeddings,","venue":null,"work_id":"895e0b31-b5d6-4ddb-a1df-e9686756d65b","year":2024},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.960076Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:bad1ec05b6dd43f8930647833e978890bc359011e1d300443fe5085bde8c9d58","observation_id":"4e4b6418-2341-49f0-98c8-e625825025f1","resolution":{"observed_at":"2026-08-12T11:12:18.671464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.656319Z","title":"Singing-voice separation from monaural recordings using robust prin- cipal component analysis,","venue":null,"work_id":"86241419-7baf-4b52-9285-5e3c8216e172","year":2012},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.963380Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:69df6ee8785c85b3997f11104d44964549d3bf42c27e4e6d679a28684c980ed8","observation_id":"41ede17a-2608-4abc-b90d-59308bcafd5a","resolution":{"observed_at":"2026-08-12T11:12:18.660447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.643943Z","title":"Speech recognition by bilateral cochlear implant users in a cocktail- party setting,","venue":null,"work_id":"ac7206b2-9258-4b3e-af30-6949f9a755a6","year":2009},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.967791Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:af73213862f040f988b33752c130b8248796c033b063b76f03b4eefc1a2b05d9","observation_id":"0f11207c-cf74-4fda-bace-e6975ab348e5","resolution":{"observed_at":"2026-08-12T11:12:18.648195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.632712Z","title":"The cocktail party robot: Sound source separation and localisation with an active binaural head,","venue":null,"work_id":"58d31f7e-6637-44a6-bb60-b465e2f68458","year":2012},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.971982Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:b63e8da6e5141c5141d7310d3b120997ca34745cabafa347d186ead0ab7c88a7","observation_id":"f1a17075-3c58-431f-a3ea-18e401a3350c","resolution":{"observed_at":"2026-08-12T11:12:18.636616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.09921","last_updated":"2020-10-05T07:12:42Z","snapshot_observed_at":"2026-08-10T03:45:18.541872Z","submitted_at":"2020-05-20T09:08:41Z","title":"End-to-End Speaker Diarization for an Unknown Number of Speakers with Encoder-Decoder Based Attractors","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.09921","snapshot_observed_at":"2026-08-12T11:12:17.975216Z","title":"End- to-end speaker diarization for an unknown number of speakers with encoder-decoder based attractors,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.975216Z"},"links":{"cited_paper":"/paper/2005.09921","citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:57f2d1d55e47e13ca854a96e586d4371c887af58bcb10fd40f869d95795682cd","observation_id":"fd2040c3-4ee0-4704-8cf3-e0c6204efd03","resolution":{"observed_at":"2026-08-12T11:12:17.975216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.621465Z","title":"Boosting unknown-number speaker separation with transformer decoder-based attractor,","venue":null,"work_id":"46a7788b-63a0-4b99-80df-73d291f0377f","year":2024},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.979538Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:dad01c6fca7651b0003545defd69aee43f45c97a842239868784ec8108874f41","observation_id":"a24905a6-7503-42c7-bc62-5ba71a0326e6","resolution":{"observed_at":"2026-08-12T11:12:18.625759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:17.982608Z","title":"Looking to listen at the cocktail party: a speaker-independent audio-visual model for speech separation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.982608Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:f8da76af932bc9e7a24e401ceda15189b7f64081535fc4939d14170911f3227d","observation_id":"05e5e8e6-48fd-4fcc-945a-ebc42d4e4440","resolution":{"observed_at":"2026-08-12T11:12:17.982608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11801","last_updated":"2023-05-21T09:32:04Z","snapshot_observed_at":"2026-08-04T02:44:15.342646Z","submitted_at":"2022-05-24T05:40:36Z","title":"SepIt: Approaching a Single Channel Speech Separation Bound","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11801","snapshot_observed_at":"2026-08-12T11:12:17.985998Z","title":"SepIt: Approaching a single channel speech separation bound,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.985998Z"},"links":{"cited_paper":"/paper/2205.11801","citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:88897824d261350066469319288ed6e0ca5431b60e5503b1d6d1f231b5243809","observation_id":"81cc6300-aed0-43e7-aa4c-2e32e5de74e0","resolution":{"observed_at":"2026-08-12T11:12:17.985998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:17.989908Z","title":"Supervised speech separation based on deep learning: An overview,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.989908Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:4e9c71ec3e4f036c213836cb859b887dd2cc9aa3f7183ab5de09d7a350c4381e","observation_id":"401310ac-70cc-4594-b6d8-362ea8b58460","resolution":{"observed_at":"2026-08-12T11:12:17.989908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.601064Z","title":"Sdr–half-baked or well done?","venue":null,"work_id":"721d281a-f5fd-4cf3-a29e-239457394466","year":2019},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.993759Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:82dca4e60bfdd6f29a0ee489536c20587a0d1bca954763a61eeedfd3c1c26ea3","observation_id":"403508a8-884e-471d-b580-c8aa5b952fa1","resolution":{"observed_at":"2026-08-12T11:12:18.605597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.590328Z","title":"Joint optimization of masks and deep recurrent neural networks for monaural source separation,","venue":null,"work_id":"c2e30b6d-13de-487d-b7da-ae9c48197926","year":2015},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:17.997086Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:4c4800558773aee5e259af1ae788fc96ab681f1d9093eb41560e5688b3f31516","observation_id":"fe2a0365-d571-44f5-8da0-4a6effd92f26","resolution":{"observed_at":"2026-08-12T11:12:18.594092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.579506Z","title":"Deep neural networks for single-channel multi-talker speech recognition,","venue":null,"work_id":"5c8053d9-1977-4af0-80d3-780bf8ab54ca","year":2015},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.000753Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:21aeb0a6d76735a86c08ee70587cfe1b4d5001885020ba43f9998701808fbfb5","observation_id":"14abe082-9809-4412-aae3-922780083853","resolution":{"observed_at":"2026-08-12T11:12:18.583478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.568503Z","title":"Deep clustering: Discriminative embeddings for segmentation and separation,","venue":null,"work_id":"3bedaeaa-b843-44d8-b73f-6839411d8163","year":2016},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.003650Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:4e19bc3d574ba27cc3d205b4290c13f3bef12d3e1dc7b98657c9ac2e05835ac5","observation_id":"b67869a5-d6bf-4b87-a126-647f4144033d","resolution":{"observed_at":"2026-08-12T11:12:18.572297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.558271Z","title":"Deep attractor network for single- microphone speaker separation,","venue":null,"work_id":"49bb532c-65e9-47ea-af41-8de2b31b35c2","year":2017},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.006696Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:caa53412f57a65d02e5b19c6ce19827c2be52706d61b093449a9ff8bcef61d86","observation_id":"26572624-61b1-4b77-9860-649a277ff3d9","resolution":{"observed_at":"2026-08-12T11:12:18.562151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.546752Z","title":"Permutation invariant training of deep models for speaker-independent multi-talker speech separation,","venue":null,"work_id":"fc75fc0a-c497-47bf-bfa8-8b66aa575fb5","year":2017},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.010792Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:ce36a043c4afcd5cf42105d8708549e427e8480a06f2d00be988e6c65801dd0e","observation_id":"0b52f99f-3e9f-45e2-9959-a2f596c01ec1","resolution":{"observed_at":"2026-08-12T11:12:18.550427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.535152Z","title":"Many-speakers single channel speech separation with optimal permutation training,","venue":null,"work_id":"8fae2a00-55b8-4fe6-ab01-e0c166e45028","year":2021},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.013949Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:08b0315ae4bd0dab2b5b19b06319c3c74e4034ff551687d7b62d72551f207a5a","observation_id":"8b4b163b-dd9c-49b8-8a65-5cd1ae083833","resolution":{"observed_at":"2026-08-12T11:12:18.538629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.017104Z","title":"Theoretical improvements in algorithmic efficiency for network flow problems,","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.017104Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:2f27514d4bd2f84eb5d0905160c8c54c12407c7ff309b193389da912d36eed73","observation_id":"1562ac92-a5e2-47b9-b845-4d5732b4cd67","resolution":{"observed_at":"2026-08-12T11:12:18.017104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.517272Z","title":"Towards listening to 10 people simultaneously: An efficient permutation invariant training of audio source separation using sinkhorn’s algorithm,","venue":null,"work_id":"01dc7447-adc1-42e1-adc3-e7f70640e08f","year":2021},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.019963Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:18852d2e62b39ed233d6d86b64ba1e0f6782fa59b483b6689c9fffc41c119409","observation_id":"d204ad37-7768-4a6e-a18b-4cd67d047354","resolution":{"observed_at":"2026-08-12T11:12:18.521417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.023631Z","title":"Sinkhorn distances: Lightspeed computation of optimal transport,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.023631Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:1503ee789abe46cac81b79497f8bdb66415b29258b02fa11c2bc3d497017bd65","observation_id":"73f0a81e-a3ff-494c-9e9e-3bf9622d48f4","resolution":{"observed_at":"2026-08-12T11:12:18.023631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15580","last_updated":"2025-01-17T10:03:39Z","snapshot_observed_at":"2026-08-12T23:17:21.310757Z","submitted_at":"2024-07-22T12:16:56Z","title":"Annealed Multiple Choice Learning: Overcoming limitations of Winner-takes-all with annealing","version":3},"cited_work":{"arxiv_id":"2407.15580","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.15580","snapshot_observed_at":"2026-08-12T11:12:18.273007Z","title":"Annealed Multiple Choice Learning: Overcoming limitations of Winner-takes-all with annealing","venue":"cs.LG","work_id":"bbe08dbe-a1c3-45e7-adbe-2dc8478febac","year":2024},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.026727Z"},"links":{"cited_paper":"/paper/2407.15580","citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:5330b08c4c9560c59a232d84ae51fbcdf91b45c1c7e7210a99d12d08d30664ca","observation_id":"352f6fcf-2f53-4f75-bb99-286180d5ba44","resolution":{"observed_at":"2026-08-12T11:12:18.276878Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.499425Z","title":"Multiple choice learning: Learning to produce multiple structured outputs,","venue":null,"work_id":"ed731be9-43d5-4b7f-95e7-d8508eaa5661","year":2012},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.030404Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:807185e021d0a606b84bfd681418a5fa76e22d800164a022048c78809d854bca","observation_id":"bbc9cfb6-26e6-4f27-b2cf-44845fb78c7b","resolution":{"observed_at":"2026-08-12T11:12:18.503725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.488293Z","title":"Stochastic multiple choice learning for training diverse deep ensembles,","venue":null,"work_id":"b34aa99c-9c26-4409-b5f8-8438f7508af3","year":2016},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.033473Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:a59dac242c604363646fe3d4625057d08ffce2c0b6fc46f19cc6ab0f4694633d","observation_id":"12ed9720-398e-4e3c-a913-80c4797c9ede","resolution":{"observed_at":"2026-08-12T11:12:18.492430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.477397Z","title":"Dsmcl: Dual-level stochas- tic multiple choice learning for multi-modal trajectory prediction,","venue":null,"work_id":"8c8c8e08-f181-4252-b5ac-bd3e930d05df","year":2020},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.037556Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:0608cc492fc2d055bfc64bef6d0bbe43585414f336962a5808c8a045624b6228","observation_id":"26a0f539-bdd0-4b45-9fb1-b13c20185f9f","resolution":{"observed_at":"2026-08-12T11:12:18.481328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.467025Z","title":"V oice separation with an unknown number of multiple speakers,","venue":null,"work_id":"c9cafed0-c480-4a80-bdf3-49111e915499","year":2020},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.040720Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:e8e2779b3f65b9380df117b68a82fa76c967ad25e9eafc639d3de8269d97272e","observation_id":"566b3b04-ee96-40da-978c-b27c15a92945","resolution":{"observed_at":"2026-08-12T11:12:18.470285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.044321Z","title":"Least squares quantization in pcm,","venue":null,"work_id":null,"year":1982},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.044321Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:8d8eda874f5194c2717fa303eefa3b2d0d8a137b2528d3fe9e04367b65cc7f3b","observation_id":"b541b667-b5c6-4505-94e5-da79b30a2cbc","resolution":{"observed_at":"2026-08-12T11:12:18.044321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.451267Z","title":"Learning in an uncertain world: Representing ambiguity through multiple hypotheses,","venue":null,"work_id":"2dee7cb0-5b0a-4646-95c8-b1c7cc8d8d02","year":2017},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.047520Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:4029143be856522fadd49c265149ce05f0b1bec318dd2552b30c9cbfbb40c834","observation_id":"96693ff2-2002-4b2e-b543-c2b7a1a374f4","resolution":{"observed_at":"2026-08-12T11:12:18.454969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.11262","last_updated":"2020-05-22T16:26:54Z","snapshot_observed_at":"2026-08-10T10:54:26.224254Z","submitted_at":"2020-05-22T16:26:54Z","title":"LibriMix: An Open-Source Dataset for Generalizable Speech Separation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.11262","snapshot_observed_at":"2026-08-12T11:12:18.051999Z","title":"Librimix: An open-source dataset for generalizable speech separation,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.051999Z"},"links":{"cited_paper":"/paper/2005.11262","citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:ab5446e5a7e9ec8906730c19f8570c748d1ff04a7d00023c719b58582e8f236e","observation_id":"06a52b33-ee20-4967-bd55-5f50280b74fd","resolution":{"observed_at":"2026-08-12T11:12:18.051999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.055529Z","title":"Conv-tasnet: Surpassing ideal time– frequency magnitude masking for speech separation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.055529Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:51a564a5b19166ac1b7f55a51027458c1f2e7d988648a7f2cfa8222dc6ee9d33","observation_id":"463f3241-96f7-4a0b-a2cb-6ac0effb008e","resolution":{"observed_at":"2026-08-12T11:12:18.055529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/9054266","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.244882Z","title":"Dual-path RNN: Efficient long sequence modeling for time-domain single-channel speech separation,","venue":null,"work_id":"a2027400-fa46-4d59-9de0-c9a9f315b836","year":2020},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.059556Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:00e37314ab1004ff799a52b497e6b499d6cd559e4cb57f8487a902d72733b835","observation_id":"62031daf-4687-48d5-9368-e05a9c5af0d0","resolution":{"observed_at":"2026-08-12T11:12:18.250379Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/9413901","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.175950Z","title":"Attention is all you need in speech separation,","venue":null,"work_id":"bdb47aae-4255-4242-9790-ebfdfb975f2d","year":2021},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.062766Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:5c41cc87625624190338b32306cb8d9a353e1d7522fda94c343b695175bf57ce","observation_id":"3f5363fd-80e1-4874-8838-5867d05ccee2","resolution":{"observed_at":"2026-08-12T11:12:18.185169Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.435036Z","title":"Mossformer: Pushing the performance limit of monaural speech separation using gated single-head transformer with convolution-augmented joint self-attentions,","venue":null,"work_id":"a1510ada-207d-48fb-a373-2b496996ddda","year":2023},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.066414Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:62cf412972b4394743ee479389aab4513c305ae1b009b3166d1b53c881cf0c80","observation_id":"a283212a-37f8-4ad6-93a3-90be41c60db1","resolution":{"observed_at":"2026-08-12T11:12:18.438809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.069514Z","title":"Tf-gridnet: Integrating full-and sub-band modeling for speech separation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.069514Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:40637535e79c62d79df3b1e2ecd0f42968b452a07974d86a7e2fa7cde97c166a","observation_id":"d9a66a66-cc06-4727-8657-ccd309c27f98","resolution":{"observed_at":"2026-08-12T11:12:18.069514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.418417Z","title":"Universal sound separation,","venue":null,"work_id":"cec793f7-8d89-445e-b049-39da2ace3b9d","year":2019},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.073584Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:0c7308ed9bb70a3505732ce7d99b272e269f65e8871bbcb2f988e3ebbc2ea60a","observation_id":"26c1d038-2237-4e16-92f7-e85f293e8eec","resolution":{"observed_at":"2026-08-12T11:12:18.422551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.407593Z","title":"Signal source separation in the analysis of neural activity in brain,","venue":null,"work_id":"d6cf6d50-b7de-4521-b54c-d2b782e5fd70","year":2001},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.076701Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:e607e537a0499e90e316740fc47e3bcfbfa09fe52222053e6dcbd5dc59b762b6","observation_id":"d37c1083-977a-446b-b388-1274ac9195e3","resolution":{"observed_at":"2026-08-12T11:12:18.411715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.395035Z","title":"Deep neural network techniques for monaural speech enhancement and separation: state of the art analysis,","venue":null,"work_id":"c22dfe32-8825-486a-a464-0047c5829b88","year":2023},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.080700Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:6cf5a49e0182483771c1d223d9799cc86df1732c484310927abe631f90cfcda9","observation_id":"02303274-6974-41f0-aeba-dd64c3473cfd","resolution":{"observed_at":"2026-08-12T11:12:18.399736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:12:18.383272Z","title":"Resilient multiple choice learning: A learned scoring scheme with application to audio scene analysis,","venue":null,"work_id":"cba9d470-a0da-422c-b2fe-bd600f4dbf84","year":2024},"citing_paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T11:12:18.083831Z"},"links":{"citing_paper":"/paper/2411.18497"},"observation_digest":"sha256:2b453448aabcf6074a1ee90d45b00ee0306700b201b089014f178538e7d8e4a7","observation_id":"564e0e2b-85a9-4b8b-bc39-e925178c6257","resolution":{"observed_at":"2026-08-12T11:12:18.387048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.18497","last_updated":"2024-11-27T16:38:34Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-12T11:06:13.204249Z","submitted_at":"2024-11-27T16:38:34Z","title":"Multiple Choice Learning for Efficient Speech Separation with Many Speakers"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":3,"verified_fuzzy":26},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2411.18497."}