{"as_of":"2026-08-17T01:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7f10c0d58da6af10f85037bd06d396d15b6e29050540239c95c1cd0820a1ea11","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:59:50.661700Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.10234/citation-record","integrity":"/paper/2509.10234/integrity","json":"/paper/2509.10234/citation-record.json","paper":"/paper/2509.10234"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:51.058346Z","title":"M2Met: The ICASSP 2022 Multi-Channel Multi-Party Meeting Transcription Challenge,","venue":null,"work_id":"f2efb9ab-1841-4ab1-b1dc-554b6dd27625","year":2022},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.551233Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:b3ba7d37ef8b5f1430aa365b440a869f68da12f7abed726154b23c1bc0bfd04f","observation_id":"8377c5a6-9301-47a4-a9db-338d929a7a12","resolution":{"observed_at":"2026-08-15T15:59:51.062807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:51.045531Z","title":"The CHiME-7 DASR Challenge: Distant meeting transcription with multiple devices in diverse scenarios,","venue":null,"work_id":"54c4b559-9367-4d29-b0c7-2a4b9bb2cb3b","year":2023},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.556735Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:278759e1b0bfcbdb6d2d7f064c3efcdc4eb69dd54c446ea361c95d4365210e8b","observation_id":"9ffd77ca-1011-482c-a8a7-0df687370153","resolution":{"observed_at":"2026-08-15T15:59:51.049691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:51.031868Z","title":"The CHiME-8 DASR Challenge for generalizable and array agnostic distant automatic speech recognition and diarization,","venue":null,"work_id":"6a7919eb-b4fc-499c-9c68-a491fc2ffdb0","year":2024},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.560869Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:7aa86d6d8f406c5f84f6287e95325dc839be7762c4ce99d9cfad09431d24d193","observation_id":"61eae245-8fb8-465c-b5cc-250a96b1375c","resolution":{"observed_at":"2026-08-15T15:59:51.036796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:51.018753Z","title":"Multi-channel transformer transducer for speech recognition,","venue":null,"work_id":"d45bc4ee-957b-4ffd-a5d4-071ba4a2c853","year":2021},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.564798Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:499e118ef3823f9b95c1d3c40331f10be114fd842cb48ab430a13a5bd447260a","observation_id":"74edc098-c7e4-448c-835c-861422535ed7","resolution":{"observed_at":"2026-08-15T15:59:51.023058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:51.004339Z","title":"The PCG-AIID system for L3DAS22 challenge: MIMO and MISO convolutional recurrent network for multi channel speech enhancement and speech recognition,","venue":null,"work_id":"106a1a04-4d9c-421c-a01a-3fb5423cae92","year":2022},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.568876Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:09d9f46102e8bc896149a450ef4dc3fe6bf52f2c4cbecc3a879e71ec0b1ca817","observation_id":"351ed256-9f22-4757-9cb8-b6d70a13e94e","resolution":{"observed_at":"2026-08-15T15:59:51.009161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.990485Z","title":"MFCCA: Multi-frame cross-channel attention for multi-speaker ASR in multi- party meeting scenario,","venue":null,"work_id":"404288cb-5e42-4cbe-9434-6ecad449b787","year":2023},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.573149Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:afc01d6431e7c2a1a0b17e0f4b0a8cc03b1cc759077a14dd1b9c840f249cd3f6","observation_id":"a5d3c4ac-cb46-41aa-8bc1-d1b93f864172","resolution":{"observed_at":"2026-08-15T15:59:50.995216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.976906Z","title":"A comparative study on multichannel speaker-attributed automatic speech recognition in multi-party meetings,","venue":null,"work_id":"2ca78e19-b31c-46d1-98a1-04ad0d33d2a1","year":2023},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.578510Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:ef886d8b60cabb320f362ae686b1abfbbf01ad12b7b40190e232d061dbe156c0","observation_id":"b44bd881-22ce-43cb-98a1-e9fb85f3f82f","resolution":{"observed_at":"2026-08-15T15:59:50.981390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.962576Z","title":"End-to-end multichannel speaker-attributed ASR: Speaker guided decoder and input feature analysis,","venue":null,"work_id":"6274f1d7-ff87-4a10-a4b7-46b109df92fc","year":2023},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.582769Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:2202b6658f8416ac027dd44271cadaad04ece5b2ec43d66aae6daac9278fe66e","observation_id":"7f4697f2-7a68-4b76-89fa-ab08bfd1c971","resolution":{"observed_at":"2026-08-15T15:59:50.966918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.949584Z","title":"Attention is all you need,","venue":null,"work_id":"cf3b7a8c-a7ba-47a0-9fe8-3ea4365a6567","year":2017},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.586635Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:14c2319c3e453ac92cacbbc3ef610f4310b8dd2894ad86eba296d597603ad27d","observation_id":"ada5b9b1-1d8a-4cad-bd24-7a376f300995","resolution":{"observed_at":"2026-08-15T15:59:50.953944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.936785Z","title":"All-neural beamformer for continuous speech separation,","venue":null,"work_id":"175d55c5-8b8a-4ea6-a00f-7e06c01cad04","year":2022},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.590781Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:fd8ed08d5a1e7a2d50a966ea4a80edc3eeae054a600ebb3c245da61a424aeb7c","observation_id":"defdebbb-1f9d-4e83-a8bf-70c1be4c1c6e","resolution":{"observed_at":"2026-08-15T15:59:50.940938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.923264Z","title":"End- to-end integration of speech recognition, dereverberation, beamforming, and self-supervised learning representation,","venue":null,"work_id":"db376ee1-8027-4e91-b5d5-057273e1b3e3","year":2023},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.594610Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:7024a90acda70f7e92f4c97529d4f8d5e98116cd6dcc7969f7773f7c1fa118f9","observation_id":"a799504f-d40a-42bd-b525-78557ba1b0c6","resolution":{"observed_at":"2026-08-15T15:59:50.927593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.909180Z","title":"Joint beamforming and speaker-attributed ASR for real distant-microphone meeting tran- scription,","venue":null,"work_id":"14c52eed-49c9-46db-8493-d589c6bc3fa1","year":2025},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.598511Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:9dbd8de6042a64431106de0fca16f64bb2f59a638477a6014a705955b797f72c","observation_id":"5a0f30f0-2582-418f-bb30-8fce3852fc02","resolution":{"observed_at":"2026-08-15T15:59:50.913886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.894468Z","title":"Integration of speech separation, diarization, and recognition for multi-speaker meetings: System descrip- tion, comparison, and analysis,","venue":null,"work_id":"4e8da540-ff92-4c48-9148-3bde62cc1e96","year":2021},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.602439Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:2a4baef5e680a459557067ab6783923129165880ff37027b183adf0271f0fedd","observation_id":"d3bf0c4e-9ff3-4459-8a1e-776df7d0caa3","resolution":{"observed_at":"2026-08-15T15:59:50.899382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.879365Z","title":"Train from scratch: Single- stage joint training of speech separation and recognition,","venue":null,"work_id":"24e6c093-8e10-469b-8b67-21edf08f4719","year":2022},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.606650Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:1f3cf8873c321a52059749718d3e71749db1a8e80a4bf28c7aa647b109330327","observation_id":"046801b2-b340-41ff-99f9-175e49d48b7e","resolution":{"observed_at":"2026-08-15T15:59:50.884643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.865175Z","title":"Varar- ray meets T-Sot: Advancing the state of the art of streaming distant conversational speech recognition,","venue":null,"work_id":"e6f6b358-5947-4ced-acf1-412b6f08efc5","year":2023},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.610553Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:98ca0ba80290f8a22f1f608a3e4cc8da221ae240d6f04bb94088387e678abe61","observation_id":"7fb8988d-b722-4336-b6ce-811601eebdee","resolution":{"observed_at":"2026-08-15T15:59:50.870424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.851372Z","title":"Automatic channel selection and spatial feature integration for multi-channel speech recognition across various array topologies,","venue":null,"work_id":"e70afe77-7581-48e4-94fb-0ec7bee9c008","year":2024},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.614551Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:7b70296f0e6c8cb17660b3c6adf0a00c3368e63d91f82e3b1ea6fea9c9013ec9","observation_id":"89acaa27-1e1c-4acb-9597-411bde80ee50","resolution":{"observed_at":"2026-08-15T15:59:50.855963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.837663Z","title":"Serialized output training for end-to-end overlapped speech recognition,","venue":null,"work_id":"5adc23d6-b637-44f7-a490-ec9bea0aab8d","year":2020},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.618428Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:592db0b59a99ff59e510ee99d60d3c4341e7551b263d742023bf384dc84fef64","observation_id":"61f785cd-8e15-4b50-be4c-7404540b9dbc","resolution":{"observed_at":"2026-08-15T15:59:50.842204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.823460Z","title":"The AMI meeting corpus: A pre-announcement,","venue":null,"work_id":"646b111f-3cf5-48ec-8fdb-fa3f0732854c","year":2005},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.622340Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:1de78a8fde8a09b136d47998c1d407a70d3299b759c9547d453bcc4981dd6c62","observation_id":"b733af6b-1444-4b77-92b8-4ba042be8620","resolution":{"observed_at":"2026-08-15T15:59:50.828507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.626347Z","title":"Vincent, T","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.626347Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:4cf4a35c4ac9e35272d39881918437957975c34ef9a225f6d6b0d1ba19c2a295","observation_id":"d6cbb986-c539-429b-8c72-55b054c7b9db","resolution":{"observed_at":"2026-08-15T15:59:50.626347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.801740Z","title":null,"venue":null,"work_id":"3cd76708-3311-42c0-816a-c91b04392d7c","year":1993},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.630368Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:cb270511b9f4968da6de59ca606fa9d7e825c09dc725068bf43045a4b3b6ede6","observation_id":"16bd8d5b-1dd3-416f-ac38-0d7a618a513b","resolution":{"observed_at":"2026-08-15T15:59:50.805902Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.787363Z","title":"Simulating realistic speech overlaps improves multi- talker ASR,","venue":null,"work_id":"bbdf9794-7530-4b2c-b7b9-61cd744df194","year":2023},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.634384Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:04dd95a506bd82e562f620fd57b54d0ac5cc5c55b40302e78ebf6383e355caaf","observation_id":"064906d7-3e1b-4643-8e5f-2ef90ae28f96","resolution":{"observed_at":"2026-08-15T15:59:50.792414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.773371Z","title":"Librispeech: An ASR corpus based on public domain audio books,","venue":null,"work_id":"c8ad29ab-cf3f-484b-8b56-7f497a08f67b","year":2015},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.638475Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:be86dcdcd319d153608e8007b8c3003243b30845b2e49f4f0b6453bf4abff59d","observation_id":"80931eda-f885-4de1-aeae-034fdceb2cb6","resolution":{"observed_at":"2026-08-15T15:59:50.777696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.759845Z","title":"Joint speaker counting, speech recognition, and speaker identification for overlapped speech of any number of speakers,","venue":null,"work_id":"03dbf7ea-e77c-47d5-bcb6-b60fd6243668","year":2020},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.642252Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:0263135eb254a6e12727368ca10bd310d527d6cef44e551a693642be64521ef0","observation_id":"4b7bfe73-efd8-47fd-a98a-7fc75163ee5d","resolution":{"observed_at":"2026-08-15T15:59:50.764448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.745833Z","title":"Sentencepiece: A simple and language inde- pendent subword tokenizer and detokenizer for neural text processing,","venue":null,"work_id":"8107ee2d-d338-4f72-bd3d-c4f22f21df30","year":2018},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.646105Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:f0f23ded1939578d79734af00aa1fbe6b8ebdb3fa38dae64293e1df7a342bec6","observation_id":"08fc5ff9-6a88-4ad9-813a-c80143cee246","resolution":{"observed_at":"2026-08-15T15:59:50.750565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.732569Z","title":"Towards low-distortion multi-channel speech enhance- ment: The ESPNet-SE submission to the L3DAS22 challenge,","venue":null,"work_id":"2cf013be-1dc1-4512-8bae-473fad40f683","year":2022},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.649824Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:e1c4fc5ff2bdc454c3e90a55eae3f2b47f536eb7b801352e0c3de9205ceaeed0","observation_id":"ac7dbd8b-c8db-463e-9351-9679a547937f","resolution":{"observed_at":"2026-08-15T15:59:50.736876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:59:50.717019Z","title":"DNN-based Parameter Estimation for MVDR Beamforming and Post-filtering,","venue":null,"work_id":"f739e135-98a4-4f71-a940-6d016f4b9692","year":2023},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.653722Z"},"links":{"citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:602d446d3c3389cbb51de659e020af5946ec17c7c3ede6801f3f271925cf4bb3","observation_id":"aa6d5130-7be7-4cfe-b22a-b0a195f34e2b","resolution":{"observed_at":"2026-08-15T15:59:50.723263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.15018","last_updated":"2022-02-16T17:48:42Z","snapshot_observed_at":"2026-08-16T17:45:47.248958Z","submitted_at":"2021-10-28T10:58:22Z","title":"TorchAudio: Building Blocks for Audio and Speech Processing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.15018","snapshot_observed_at":"2026-08-15T15:59:50.657470Z","title":"Torchaudio: Building blocks for audio and speech processing,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.657470Z"},"links":{"cited_paper":"/paper/2110.15018","citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:fa124dbc72a0f459ffab9947f167bc798193f4e1ce1beaf7a6e207b0d86e1f75","observation_id":"20b0066c-08bc-4209-88d3-a0ff7b7a956e","resolution":{"observed_at":"2026-08-15T15:59:50.657470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04624","last_updated":"2021-06-08T18:22:56Z","snapshot_observed_at":"2026-08-16T23:10:15.763755Z","submitted_at":"2021-06-08T18:22:56Z","title":"SpeechBrain: A General-Purpose Speech Toolkit","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.04624","snapshot_observed_at":"2026-08-15T15:59:50.661700Z","title":"SpeechBrain: A general-purpose speech toolkit,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T15:59:50.661700Z"},"links":{"cited_paper":"/paper/2106.04624","citing_paper":"/paper/2509.10234"},"observation_digest":"sha256:b2ead2f3ae0ad909db6cf4afa48cdbf33444d10885929fa55cf13cdda6043a7a","observation_id":"534df2ed-ea35-4613-877f-0e19fe1f9387","resolution":{"observed_at":"2026-08-15T15:59:50.661700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.10234","last_updated":"2025-09-12T13:27:49Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-16T14:08:17.559543Z","submitted_at":"2025-09-12T13:27:49Z","title":"Data-independent Beamforming for End-to-end Multichannel Multi-speaker ASR"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2509.10234."}