{"as_of":"2026-08-10T02:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e903b0106b180824adbed2cc29446b02f41b112bb44b1120c2fcc4f1de868979","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:00:29.258049Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:00:24.448079Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T20:34:19.302217Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16607","snapshot_observed_at":"2026-08-07T15:00:24.448079Z","title":"Here, the observed signalyconsists of speech signalsx c from Csources and noisen","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:24.448079Z"},"links":{"cited_paper":"/paper/2505.16607","citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:6bd4a3303843169ae884e02202d5d76afdbf268b52164c4e1fae6c550a5a91c7","observation_id":"b7254c3c-488d-4c8b-a3f0-1405dda55ae0","resolution":{"observed_at":"2026-08-07T15:00:24.448079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"cited_work":{"arxiv_id":"2505.16607","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16607","snapshot_observed_at":"2026-08-06T20:34:19.302217Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","venue":"eess.AS","work_id":"043ceae9-26e1-4627-98a6-aa893e5fda1e","year":2025},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.479293Z"},"links":{"cited_paper":"/paper/2505.16607","citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:de091e8461f020e10c7cf32654d8e426a39b1ce7ba0a81d4cda34126f5ddc813","observation_id":"d033676c-bc22-4840-8d9d-e9b7d4b82078","resolution":{"observed_at":"2026-08-06T20:34:19.369203Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.16607/citation-record","integrity":"/paper/2505.16607/integrity","json":"/paper/2505.16607/citation-record.json","paper":"/paper/2505.16607"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:36.646235Z","title":null,"venue":null,"work_id":"0468bc60-e9d9-4d69-ad84-242de786c5d0","year":null},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:24.372754Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:9cc9f266aed069733ae0c0e73744c36501d6315c6b0e426f7554d3499b9f7f77","observation_id":"fbab1a37-1740-4382-98e0-e6b251ec30a9","resolution":{"observed_at":"2026-08-07T15:00:36.775069Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16607","snapshot_observed_at":"2026-08-07T15:00:24.448079Z","title":"Here, the observed signalyconsists of speech signalsx c from Csources and noisen","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:24.448079Z"},"links":{"cited_paper":"/paper/2505.16607","citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:6bd4a3303843169ae884e02202d5d76afdbf268b52164c4e1fae6c550a5a91c7","observation_id":"b7254c3c-488d-4c8b-a3f0-1405dda55ae0","resolution":{"observed_at":"2026-08-07T15:00:24.448079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:36.314265Z","title":"The system architecture is illustrated in Fig","venue":null,"work_id":"dcdda098-9b36-4395-bdff-f51c67a55722","year":null},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:24.505302Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:2ec4def58d21b40015ac4ef43afd472206b2eacae4558c5dcb3eb6ecf24584a1","observation_id":"580e4802-322e-4659-bfdb-8f65d740001c","resolution":{"observed_at":"2026-08-07T15:00:36.453516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:36.032666Z","title":"Datasets In our research scenario, multiple speakers coexist in a mixed signal, each contributing multiple utterances","venue":null,"work_id":"2f47b2f7-c440-402b-96d4-2dea55bbc9ce","year":null},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:24.598420Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:cb9c58f0a5a33675d1a48c265996dff7093edbf8319015a6b5fdb9d2db854116","observation_id":"ae563731-4ec3-4837-b1f7-1fd3be5a1383","resolution":{"observed_at":"2026-08-07T15:00:36.150119Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:35.879694Z","title":"Besides, an ablation study was conducted Table 2:Evaluation on 2-speaker & 3-speaker dataset","venue":null,"work_id":"983edcb7-d910-41af-ba20-0edf8b0b1192","year":null},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:24.696572Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:b994d60e31f3d55ed977722b03dd3ef73a6b070f15a927d3193ea6c59d744fbf","observation_id":"5f36cf49-7045-4fb0-828a-7af1ca3fa1d8","resolution":{"observed_at":"2026-08-07T15:00:35.955449Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:35.704196Z","title":"The system employs an RNN attractor module to estimate the number of sources and detect source ac- tivity, resulting in significant improvements in separation per- formance","venue":null,"work_id":"b7710fdc-b355-414c-8153-f33ae364fbfc","year":null},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:24.831958Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:77ee2bc6ea7b31025d252d3f02bcd0fb82b0d070ccf79d992c84257cc9867532","observation_id":"9438d5a7-f8e5-476d-b2d4-34c3b74b0b00","resolution":{"observed_at":"2026-08-07T15:00:35.806354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:35.551287Z","title":"Vincent, T","venue":null,"work_id":"d79c19bf-07e3-481e-a9b7-baa54524bc17","year":2018},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:24.920680Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:e2d51e7e2e501a25f7f703d4e2050435b02b0f4be85b743edff81d3072e3b25f","observation_id":"5b9e624b-505f-436f-8eb5-4e3c1e28804b","resolution":{"observed_at":"2026-08-07T15:00:35.622401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:35.427456Z","title":"Deep learning for audio signal processing,","venue":null,"work_id":"4ca5334d-7719-4df6-a400-d4f3afd471ae","year":2019},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:24.975941Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:be9e77dcc5b2605961970bce8c49ff87de7d97c2e491213f36ee8a4a3ee0fdd0","observation_id":"6bb44864-208a-47f9-a97d-1becf5a1dbfe","resolution":{"observed_at":"2026-08-07T15:00:35.490807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:35.252204Z","title":"An overview of machine learning and other data-based methods for spatial au- dio capture, processing, and reproduction,","venue":null,"work_id":"a7befa76-864d-4a7d-950c-cedab123ada8","year":2022},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:25.042061Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:8cb41c8bc0116e099e7d9f8f38ca38206e21acd25a23ff9a4615b92fa5f3e0d5","observation_id":"b56d5567-9b41-494b-bd08-1766f6ebc1b5","resolution":{"observed_at":"2026-08-07T15:00:35.357989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:25.186758Z","title":"Supervised speech separation based on deep learning: An overview,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:25.186758Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:16133ea5a66723ca596538acd2a90e847477e02069cec4b378387195d90d7480","observation_id":"f4a1951a-20d4-43f8-b26f-c110d8cd4784","resolution":{"observed_at":"2026-08-07T15:00:25.186758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:35.083621Z","title":"Conv-tasnet: Surpassing ideal time– frequency magnitude masking for speech separation,","venue":null,"work_id":"5428e04a-1537-4058-9997-0c0a90b3eb36","year":2019},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:25.295428Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:d06ff5c91f5feeddc02f364702abb90db817f8e718e139823ba6b7f6081becab","observation_id":"d0fc8161-d7ce-4f97-a67e-1b57cb5ba984","resolution":{"observed_at":"2026-08-07T15:00:35.169008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:25.404765Z","title":"Dual-Path RNN: Efficient long sequence modeling for time-domain single-channel speech sepa- ration,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:25.404765Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:db4c9055142bdc5cebbdaa570f2d3b8926bdb29b768fdd26a3467574bb402f2f","observation_id":"5e1a1025-effe-445d-a637-2b27118f1084","resolution":{"observed_at":"2026-08-07T15:00:25.404765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:34.907938Z","title":"Permutation invari- ant training of deep models for speaker-independent multi-talker speech separation,","venue":null,"work_id":"2041a993-292f-49ea-ae90-8836e5f29b9f","year":2017},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:25.535726Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:e123a6647d5d9ffaafc810337a0027e19dc42bf795f040d83f23128cbde52b36","observation_id":"5c3a4836-c997-49a6-9115-c756b3ae674d","resolution":{"observed_at":"2026-08-07T15:00:34.953585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:34.737692Z","title":"Multitalker speech separation with utterance-level permutation invariant train- ing of deep recurrent neural networks,","venue":null,"work_id":"0e2eacd5-a64c-46da-8333-6cab08fb8f21","year":1901},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:25.676422Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:1a003201a4203f7de4c5ceebf70e7413db0375165b2e6e2d6c4ab1f9dc14bd24","observation_id":"d9b3b7c6-6b71-4532-aa53-122598a1062a","resolution":{"observed_at":"2026-08-07T15:00:34.806139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:25.883371Z","title":"Attention is all you need in speech separation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:25.883371Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:84ca8f28f512f57f9442365a935e207bfe4b7a78f05b435fb9edee9aea27562e","observation_id":"7814764c-25e6-4998-85e8-ed72e1fcdc76","resolution":{"observed_at":"2026-08-07T15:00:25.883371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:34.544471Z","title":"Dual-path transformer network: Direct context-aware modeling for end-to-end monaural speech separation,","venue":null,"work_id":"14e2deff-2762-45cb-80ee-66cb74340153","year":2020},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:25.993737Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:f12157f34933f94e95496a3f219080494b6f29630edeeecd4fefde4f492cd13e","observation_id":"0e491b13-ecfc-445c-96d6-f003ed3437a0","resolution":{"observed_at":"2026-08-07T15:00:34.615974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:34.311172Z","title":"TF-GridNet: Making time-frequency domain models great again for monaural speaker separation,","venue":null,"work_id":"9009e527-0faa-413b-a994-73b2ad96ebc1","year":2023},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:26.158658Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:ec4f13a3349e3c0131e32221e811494443d04193110d6dbe668f549e2b7da2d4","observation_id":"4081ad1c-2eba-41c7-89fe-d77a3fa3b4d6","resolution":{"observed_at":"2026-08-07T15:00:34.410295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:34.070949Z","title":"TF-GridNet: Integrating full- and sub-band modeling for speech separation,","venue":null,"work_id":"c34ea62c-bcc0-4918-b43d-e8a7a8d7e122","year":2023},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:26.319957Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:2ab509170516f2b2a8f5991699a0a26a20c33769b553b16caa6b70b7eb8f84f8","observation_id":"8f1d6cc6-b77e-44de-a822-addee69109ad","resolution":{"observed_at":"2026-08-07T15:00:34.185511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:33.806499Z","title":"Recursive speech separation for unknown number of speak- ers,","venue":null,"work_id":"9c2bcdd4-c2a2-4f1a-8f13-93da5985c569","year":2019},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:26.487513Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:28aa0364be45846acf678d215b47c03f340631eb0630b77d0c26518c0c0d1861","observation_id":"dbcd0ac4-d557-4120-8c7c-99fd6ac11a77","resolution":{"observed_at":"2026-08-07T15:00:33.937374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:33.571151Z","title":"Listen- ing to each speaker one by one with recurrent selective hearing networks,","venue":null,"work_id":"f6925217-1a6a-4308-a08f-bdd8b5974e0f","year":2018},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:26.547122Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:4e8d49f96e8f1fd6b06012110e7ccc3210bed64fbbf14243f121ee445575f262","observation_id":"f71c6fd3-1d8b-4e3b-a8ec-265305052112","resolution":{"observed_at":"2026-08-07T15:00:33.670488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:33.308638Z","title":"Deep Clus- tering: Discriminative embeddings for segmentation and separa- tion,","venue":null,"work_id":"64957068-488b-438d-88f8-3aa36922c28b","year":2016},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:26.729483Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:15e162f39263e0f93da5737c461f4f46b9274863e8fbbe3653c74c38bc28e91f","observation_id":"96496c79-9217-4492-83d0-1a039773e086","resolution":{"observed_at":"2026-08-07T15:00:33.425090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:33.105141Z","title":"Low-latency deep clus- tering for speech separation,","venue":null,"work_id":"73e3b1ff-1c35-412f-8b9c-223d5b9d1332","year":2019},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:26.904907Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:b080ecf822c439bf5b40a9de0f5366dc3a87f37afe49d9e1f917bfb710a29ccb","observation_id":"e90f6f01-977f-4ddd-9cec-b1bd66a690ec","resolution":{"observed_at":"2026-08-07T15:00:33.206808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:27.028221Z","title":"Wavesplit: End-to-end speech separation by speaker clustering,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:27.028221Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:85831bfb277beda09b0c825460c33b3c427b3b3c9b7d92af608f11e1363b5e03","observation_id":"c20037d9-059c-4e81-9054-cc164b440e9e","resolution":{"observed_at":"2026-08-07T15:00:27.028221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:27.121484Z","title":"Deep attractor network for single-microphone speaker separation,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:27.121484Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:a2e0769cd29f236751a9a3b0dcda7862a85677f97312d252fb7b139c97fcbc1f","observation_id":"3ec4b8ec-1ab0-4b63-bf4d-272ffe9aea19","resolution":{"observed_at":"2026-08-07T15:00:27.121484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:32.827396Z","title":"Speaker-independent speech separation with deep attractor network,","venue":null,"work_id":"8dd3e76d-ba59-4271-acf7-61c18c5a814c","year":2018},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:27.302656Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:da72deb3d2c5da9c956ac01c8c967c26efc0658bee53c84365aef201f5dbf63b","observation_id":"ed98ec93-96d8-4528-b6f9-9c22700daf3b","resolution":{"observed_at":"2026-08-07T15:00:32.948408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:32.590791Z","title":"EEND-SS: Joint end-to-end neural speaker diariza- tion and speech separation for flexible number of speakers,","venue":null,"work_id":"69797031-3c1d-4abd-8a95-71c64d3e25ff","year":2023},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:27.461843Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:21d6d2aa8d073e480a9bfc3abbe26d4c4b797b87540395d3bedd10332b836cf0","observation_id":"5bde063a-d799-4c8b-8a3d-1aac9839f90a","resolution":{"observed_at":"2026-08-07T15:00:32.703627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:32.374242Z","title":"Speech separation for an unknown number of speakers using transformers with encoder- decoder attractors,","venue":null,"work_id":"eeba01f2-b72a-498f-b505-95eda48b93e1","year":2022},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:27.583445Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:52ffb025d81eb77ea61972726f44275cfcd1ef722d9971af45eb62947a453bcf","observation_id":"f6d46933-6b9e-4c91-8346-eefe7da29762","resolution":{"observed_at":"2026-08-07T15:00:32.488668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:32.165193Z","title":"Boosting unknown-number speaker separation with transformer decoder-based attractor,","venue":null,"work_id":"01ab2c73-ce80-4f27-a900-63fb27253ee4","year":2024},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:27.727743Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:1df6304748d65890f2f89bce9546b4744dc42e33ceb69e06b78dd02592b597eb","observation_id":"a11aa4d3-e921-4898-8086-83edf5fad330","resolution":{"observed_at":"2026-08-07T15:00:32.272759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:31.840639Z","title":"Continuous speech separation with recurrent selective at- tention network,","venue":null,"work_id":"39db52ca-cfd9-4f7a-a1f3-efaf92a0c504","year":2022},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:27.834622Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:bab0d579a76c37c947d78370ca1d044465396a6ed4a750ac7ec485cef222932a","observation_id":"7020bb74-e9a9-401f-921f-ccfa7c3414b7","resolution":{"observed_at":"2026-08-07T15:00:31.986823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:31.531844Z","title":"All-neural beamformer for continuous speech separation,","venue":null,"work_id":"95484a86-a82c-4f63-abef-6ba40e9bc35c","year":2022},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:27.982705Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:56fab9e94564dea0ef87c869870e1adaabc69be0f19a722a9747112973d8d79d","observation_id":"4499698d-8e50-4de1-b552-ed2ccf4c212f","resolution":{"observed_at":"2026-08-07T15:00:31.670241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:31.281378Z","title":"Continuous stream- ing multi-talker asr with dual-path transducers,","venue":null,"work_id":"b8b8552c-75e7-4ed2-a2e6-ae8c436509d5","year":2022},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:28.185553Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:fc7f35a036bdbcf78baa8f6ad934d80bf936525d8beb11c33494c7eeb2b5a6f6","observation_id":"24125053-4242-4b0d-b11b-6a7997dca5b3","resolution":{"observed_at":"2026-08-07T15:00:31.409040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:31.029456Z","title":"Continuous speech separation: Dataset and analysis,","venue":null,"work_id":"b8dec52f-b1b2-4789-97a9-69887e43592f","year":2020},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:28.293346Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:81bae955037021dbaf8f38afb79ab3dfe09302069f577b7304b19b4b9c060f4a","observation_id":"4adb06fa-23eb-4c47-95d1-007b22c559a2","resolution":{"observed_at":"2026-08-07T15:00:31.149028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:30.814005Z","title":"Dual-path rnn for long recording speech separation,","venue":null,"work_id":"a3d7a114-ab82-4176-86f5-1de8a3990d1b","year":2021},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:28.408150Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:506ed902bd7e175690159bff258ec417ec93f4e6aef6de954265227ec675660e","observation_id":"a904bfaf-77e2-4811-9af2-56fd1f90d82e","resolution":{"observed_at":"2026-08-07T15:00:30.904792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:30.561479Z","title":"FiLM: Visual reasoning with a general conditioning layer,","venue":null,"work_id":"70ddbb3d-fc77-4dcf-aaac-4fd6dbbf10be","year":2018},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:28.510201Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:f35d6642df2d9f18f7b08fbc8b83405947186bef6d18f1d5e6cb98b17aa78c0c","observation_id":"6b891667-317a-4d79-a4ec-86cdd0d6afc8","resolution":{"observed_at":"2026-08-07T15:00:30.657408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.09921","last_updated":"2020-10-05T07:12:42Z","snapshot_observed_at":"2026-07-06T09:21:53.517585Z","submitted_at":"2020-05-20T09:08:41Z","title":"End-to-End Speaker Diarization for an Unknown Number of Speakers with Encoder-Decoder Based Attractors","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.09921","snapshot_observed_at":"2026-08-07T15:00:28.711166Z","title":"End-to-end speaker diarization for an unknown number of speak- ers with encoder-decoder based attractors,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:28.711166Z"},"links":{"cited_paper":"/paper/2005.09921","citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:71b4981a672b49623db53695e2aa1e839df3f8e8f84ba0a89f7f1d9de36c976d","observation_id":"1cf1b140-71a4-4e3b-ad7e-8a3d08198bbe","resolution":{"observed_at":"2026-08-07T15:00:28.711166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:30.392535Z","title":"Lib- riSpeech: an ASR corpus based on public domain audio books,","venue":null,"work_id":"6c128301-944b-4a39-9b2e-7d9732c54d0f","year":2015},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:28.800291Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:7c055b0c53b779ef4d1fd838c74ef08992cb591f08e572ea496d1672bd76b595","observation_id":"b95f4bf6-f12f-4151-b2f8-47cfd3d8076e","resolution":{"observed_at":"2026-08-07T15:00:30.481894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:28.891113Z","title":"WHAM!: Extending speech separation to noisy environments,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:28.891113Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:bcf8a148fec8510ce0e1cd8cd0520cf08bb03a080164af1765644f8cdbe43a64","observation_id":"e60c9a80-df23-4d91-af05-454c339a7dca","resolution":{"observed_at":"2026-08-07T15:00:28.891113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:30.249246Z","title":"gpuRIR: A python library for room impulse response simulation with gpu accelera- tion,","venue":null,"work_id":"fe1e7ca4-2028-4e97-973f-e3efe154763e","year":2021},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:28.997967Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:354c3580c3dcdb6a4a3f11c94de322517e6bdabac367081a2990c3ad08f59a21","observation_id":"cc8395ab-922e-47b3-bbf4-88804e31a606","resolution":{"observed_at":"2026-08-07T15:00:30.307060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:29.980017Z","title":"ESPnet: End-to-end speech processing toolkit,","venue":null,"work_id":"f11a8ab6-dd14-442a-9199-3ca8edfc06f7","year":2018},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:29.070196Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:8033da38de6beaf3653ef942d52c09e7a16feb3e45cf0b09cee5b30298828cc8","observation_id":"2c9344e0-ff74-4027-bbbc-46a08fc13dfe","resolution":{"observed_at":"2026-08-07T15:00:30.110930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:29.700027Z","title":"SDR – half-baked or well done?","venue":null,"work_id":"780a463b-6f13-4585-a6bc-1feac89b8233","year":2019},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:29.133551Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:3a9b514370864f4aae57e37fe6111ac1044f31461b825456075a82e42c8835c4","observation_id":"e63995fa-500f-426a-898e-ff9ab9dc0275","resolution":{"observed_at":"2026-08-07T15:00:29.835568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:29.542892Z","title":"The rich tran- scription 2006 spring meeting recognition evaluation,","venue":null,"work_id":"18bddc68-bca3-4aaf-8b54-2225ca50418e","year":2006},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:29.201944Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:76b215159dd41900a5b0ae07ea2783e68547e8c19e0e5b4cd2423667f33a6395","observation_id":"dfff03c4-4aef-49a0-a549-f1a739e6d747","resolution":{"observed_at":"2026-08-07T15:00:29.616065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:00:29.427914Z","title":"Speaker counting and sep- aration from single-channel noisy mixtures,","venue":null,"work_id":"977f3cc7-6cbd-4587-81b4-02f46626446c","year":2023},"citing_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:29.258049Z"},"links":{"citing_paper":"/paper/2505.16607"},"observation_digest":"sha256:b4658da413cccfba1df39e679b6a20e88bca5f3a602480692878d2888d92f722","observation_id":"8d2f2f66-e2f0-428c-a30d-1f2f2c0aa466","resolution":{"observed_at":"2026-08-07T15:00:29.461772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":31},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 2 inbound Pith citation observations for arXiv:2505.16607."}