{"as_of":"2026-08-09T12:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:57dc3449ac9d2bc6bacbdd64f5bc09a2fe9223e285a2937c20b490d5d12bf542","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:02:18.872390Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:02:16.624199Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T20:16:12.215607Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23036","snapshot_observed_at":"2026-08-07T13:02:16.624199Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:16.624199Z"},"links":{"cited_paper":"/paper/2505.23036","citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:19f71fa37421126dfbf6a7ab190da7105b48109c6f14e61cc456c7633845fe79","observation_id":"82167eed-5ce5-472e-aeae-17954c426521","resolution":{"observed_at":"2026-08-07T13:02:16.624199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"cited_work":{"arxiv_id":"2505.23036","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23036","snapshot_observed_at":"2026-07-01T20:16:12.215607Z","title":"Aishell-5: The first open-source in-car multi-channel multi-speaker speech dataset for automatic speech diarization and recognition","venue":null,"work_id":"508bf608-b0cb-41d1-94dd-70157758e196","year":2025},"citing_paper":{"arxiv_id":"2508.07285","last_updated":"2026-05-19T14:44:40Z","snapshot_observed_at":"2026-08-05T00:29:45.624756Z","submitted_at":"2025-08-10T10:46:14Z","title":"Non-Intrusive Automatic Speech Recognition Refinement: A Survey","version":3},"reference_index":167,"source":"pdf_text","source_observed_at":"2026-05-21T23:34:52.249143Z"},"links":{"cited_paper":"/paper/2505.23036","citing_paper":"/paper/2508.07285"},"observation_digest":"sha256:5571d796e38332d149ec4c51b90706a975fd7f6b334dd0f874833ca5144c13b3","observation_id":"cf7d77ba-97f9-413c-a2c0-bed1d9187391","resolution":{"observed_at":"2026-05-21T23:35:45.906902Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"cited_work":{"arxiv_id":"2505.23036","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23036","snapshot_observed_at":"2026-07-01T20:16:12.215607Z","title":"Aishell-5: The first open-source in-car multi-channel multi-speaker speech dataset for automatic speech diarization and recognition","venue":null,"work_id":"508bf608-b0cb-41d1-94dd-70157758e196","year":2025},"citing_paper":{"arxiv_id":"2605.30899","last_updated":"2026-05-29T06:33:36Z","snapshot_observed_at":"2026-08-04T13:19:05.357869Z","submitted_at":"2026-05-29T06:33:36Z","title":"A Unified and Reproducible Experimentation Framework for Speech Understanding","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T21:20:16.428207Z"},"links":{"cited_paper":"/paper/2505.23036","citing_paper":"/paper/2605.30899"},"observation_digest":"sha256:206ced2999c375bc56084d50faaddb580bb286ef460378352ce115a7216b9654","observation_id":"d3548ec0-aed3-4855-8934-4fd9c98a649c","resolution":{"observed_at":"2026-07-01T20:16:12.217425Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.23036/citation-record","integrity":"/paper/2505.23036/integrity","json":"/paper/2505.23036/citation-record.json","paper":"/paper/2505.23036"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23036","snapshot_observed_at":"2026-08-07T13:02:16.624199Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:16.624199Z"},"links":{"cited_paper":"/paper/2505.23036","citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:19f71fa37421126dfbf6a7ab190da7105b48109c6f14e61cc456c7633845fe79","observation_id":"82167eed-5ce5-472e-aeae-17954c426521","resolution":{"observed_at":"2026-08-07T13:02:16.624199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:02:22.012964Z","title":"Additionally, each speaker wears a high-fidelity micro- phone to collect near-field audio for data annotation","venue":null,"work_id":"98816d65-be86-4f7f-a499-aff7b8504712","year":null},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:16.737473Z"},"links":{"citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:3fdc5a0ca55e0a137a008d8add933e1cb7b6c2703ce9d58e276d4fe91bda3fbf","observation_id":"3b577577-a875-4da2-83b8-c403f77b794d","resolution":{"observed_at":"2026-08-07T13:02:22.127061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8969.5553","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:02:19.371996Z","title":"The baseline system con- sists of two primary sub-modules: speech frontend processing and automatic speech recognition (ASR)","venue":null,"work_id":"071decfc-84b2-4074-981b-832b8d0e1638","year":null},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:16.841267Z"},"links":{"citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:28745ad15c6565afc2e8a7f26efa2387fa0077947382c6a8440e3946c0ababdb","observation_id":"092e6d19-67cf-4e4a-ae30-8bb63c608deb","resolution":{"observed_at":"2026-08-07T13:02:19.424949Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:02:21.824255Z","title":"AISHELL-5 is suitable for speech sep- aration, speech enhancement, noise reduction, and automatic speech recognition (ASR) tasks targeting in-car scenarios","venue":null,"work_id":"a0165727-59fe-40c2-afec-8c3ba61af8ef","year":null},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:17.000499Z"},"links":{"citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:677ac1a5b8794f704031b276a16d8850f3e52aed537b26bc6275383d4d63427b","observation_id":"29325b22-6c87-408e-a481-0237d1e00ea6","resolution":{"observed_at":"2026-08-07T13:02:21.902935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.03603","last_updated":"2021-08-10T09:15:00Z","snapshot_observed_at":"2026-07-06T10:57:34.353038Z","submitted_at":"2021-04-08T08:38:44Z","title":"AISHELL-4: An Open Source Dataset for Speech Enhancement, Separation, Recognition and Speaker Diarization in Conference Scenario","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.03603","snapshot_observed_at":"2026-08-07T13:02:17.150613Z","title":"AISHELL-4: An open source dataset for speech enhancement, separation, recognition and speaker diariza- tion in conference scenario,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:17.150613Z"},"links":{"cited_paper":"/paper/2104.03603","citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:e355cce47a055b2d277030814c17266d780a6d658206cd6540171ec4f65afd56","observation_id":"215e0546-d753-4933-98c7-10ae35ed5646","resolution":{"observed_at":"2026-08-07T13:02:17.150613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:02:21.617474Z","title":"M2met: The icassp 2022 multi- channel multi-party meeting transcription challenge,","venue":null,"work_id":"ba87d4f4-bda9-4f89-8028-ea6ee14f173b","year":2022},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:17.242049Z"},"links":{"citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:24b12a891bd7764092f187cabd48e407681b1266ed4aa7d50052175958554d43","observation_id":"73542d1e-0c1d-495d-8ae7-107114fd649a","resolution":{"observed_at":"2026-08-07T13:02:21.704655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.11262","last_updated":"2020-05-22T16:26:54Z","snapshot_observed_at":"2026-08-04T10:15:33.124350Z","submitted_at":"2020-05-22T16:26:54Z","title":"LibriMix: An Open-Source Dataset for Generalizable Speech Separation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.11262","snapshot_observed_at":"2026-08-07T13:02:17.367614Z","title":"Librimix: An open-source dataset for generalizable speech separation,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:17.367614Z"},"links":{"cited_paper":"/paper/2005.11262","citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:bbcbc3c34a9e92c7a04e9fdac6b0ed1887e3f66b3d6a2fc67db328e3f435cd9e","observation_id":"fdbc0bb6-2d51-466e-966c-b009ac9d16e8","resolution":{"observed_at":"2026-08-07T13:02:17.367614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:02:21.386531Z","title":"Lib- rispeech: An asr corpus based on public domain audio books,","venue":null,"work_id":"d519531c-8336-4308-885f-3f1758e319c3","year":2015},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:17.453376Z"},"links":{"citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:a4fc3e051f520392589b288317e2c2092a7a560e270ed448ebd9f496cf891470","observation_id":"1dd913d0-0488-4074-ab2b-fd349777bd9c","resolution":{"observed_at":"2026-08-07T13:02:21.515267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01160","last_updated":"2019-07-02T04:27:55Z","snapshot_observed_at":"2026-07-06T08:04:17.909965Z","submitted_at":"2019-07-02T04:27:55Z","title":"WHAM!: Extending Speech Separation to Noisy Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.01160","snapshot_observed_at":"2026-08-07T13:02:17.550805Z","title":"Wham!: Extend- ing speech separation to noisy environments,","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:17.550805Z"},"links":{"cited_paper":"/paper/1907.01160","citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:21773138827acefc9cac09c18da339418efc3eafa7850d85cc195b4d4dfd5b98","observation_id":"2515089f-8a20-49ae-8e71-4c40962c3d9b","resolution":{"observed_at":"2026-08-07T13:02:17.550805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.09470","last_updated":"2017-11-26T22:08:50Z","snapshot_observed_at":"2026-07-06T06:11:14.495709Z","submitted_at":"2017-11-26T22:08:50Z","title":"Realistic multi-microphone data simulation for distant speech recognition","version":1},"cited_work":{"arxiv_id":"1711.09470","doi":null,"metadata_source":"pith","pith_arxiv_id":"1711.09470","snapshot_observed_at":"2026-08-07T13:02:19.112869Z","title":"Realistic multi-microphone data simulation for distant speech recognition","venue":"eess.AS","work_id":"80fbe5c3-6444-4817-b358-8529b9875226","year":2017},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:17.684377Z"},"links":{"cited_paper":"/paper/1711.09470","citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:ff9c1a1c7ce78630b0149a3ba77db75cbe50e59322bb7e13383afc37d0f1e6ac","observation_id":"3e14967a-12b0-46c7-9d39-4702c26907e3","resolution":{"observed_at":"2026-08-07T13:02:19.163511Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:02:21.202473Z","title":"Effective noise-aware data simulation for domain- adaptive speech enhancement leveraging dynamic stochastic per- turbation,","venue":null,"work_id":"a478b7e2-6b00-4677-8561-e14e9bfcfc20","year":2024},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:17.775325Z"},"links":{"citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:0678a6895dea2b0e0998a3a20d578a1ee3a74f5ac86a9a02927a48ee9a1a52f2","observation_id":"8e8375a5-61d5-4daa-99a2-cb8c4cc3ae75","resolution":{"observed_at":"2026-08-07T13:02:21.290358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:02:21.020520Z","title":"The iscslp 2022 intelligent cock- pit speech recognition challenge (icsrc): Dataset, tracks, baseline and results,","venue":null,"work_id":"57f5affe-0f99-4718-b589-0abfa5335ae6","year":2022},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:17.859859Z"},"links":{"citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:6b42efe1c0db01a211b0688a727a5c1ca3e6ed0065712b4a05a0abafce8f8a9a","observation_id":"c02e67da-65bf-4d3b-8147-7c502bf516d6","resolution":{"observed_at":"2026-08-07T13:02:21.088237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:02:20.785753Z","title":"ICMC-ASR: the ICASSP 2024 in-car multi- channel automatic speech recognition challenge,","venue":null,"work_id":"b8353278-f2ca-4736-ba6e-8f7a6285bf97","year":2024},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:17.966522Z"},"links":{"citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:5f19c5c2021317c903a74b2ca9bbd795be4f33508ad689bbd43c091afafdfbd5","observation_id":"87077904-6367-4ef6-a4d3-c31f08a9eca2","resolution":{"observed_at":"2026-08-07T13:02:20.912275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:02:20.650379Z","title":"Paraformer: Fast and accurate parallel transformer for non-autoregressive end-to- end speech recognition,","venue":null,"work_id":"d558accd-a7f0-42f8-b6f2-031124cc4ffb","year":2022},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:18.070056Z"},"links":{"citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:e154e0ce177f98999f02d383e2c81228ca89ac9ab3ecf8f10418a2809fa05ea5","observation_id":"deb3863a-1491-4473-8536-1231dd394702","resolution":{"observed_at":"2026-08-07T13:02:20.702220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:02:18.145296Z","title":"Robust speech recognition via large-scale weak su- pervision,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:18.145296Z"},"links":{"citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:91db3bf871b4a159fb6cdf061790840fff976f3361e3eb6c5b8f59189d2ce692","observation_id":"dadd2573-9f62-4dde-a78a-ede398f3adcd","resolution":{"observed_at":"2026-08-07T13:02:18.145296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:02:20.376543Z","title":"Funaudiollm: V oice understanding and genera- tion foundation models for natural interaction between humans and llms,","venue":null,"work_id":"5a04e238-a4d2-4471-8f38-cb0a0c95fed1","year":2024},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:18.226968Z"},"links":{"citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:b46dc1f76e86a86d638cc6c717b0e8d4d88d593e4adca52319a2b3f5c0a25cd9","observation_id":"8a7c6960-92a5-4066-8d93-2bae2534e090","resolution":{"observed_at":"2026-08-07T13:02:20.480466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-07T13:02:18.317706Z","title":"Qwen2-audio technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:18.317706Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:aadb88eff67ebcaa905ffb0e91a111a61beaea2e78ca95b9ee74fb978df8ce2d","observation_id":"2a3172ab-101e-4eb6-9e0a-678652c7d356","resolution":{"observed_at":"2026-08-07T13:02:18.317706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:02:20.194063Z","title":"Independent vector analysis: An extension of ICA to multivariate components,","venue":null,"work_id":"99e33cf3-0830-48fc-bf56-9b3b601e0fd0","year":2006},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:18.415591Z"},"links":{"citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:a25602bdc7f94340355766aee0a6a822d2caa3c5caf7516fb65f2fd657c73f75","observation_id":"505e2d5a-11b0-425f-bf6f-34df8a30cbe2","resolution":{"observed_at":"2026-08-07T13:02:20.286774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:02:20.001207Z","title":"Speech-transformer: A no- recurrence sequence-to-sequence model for speech recognition,","venue":null,"work_id":"c5d9c409-e72e-4657-9fa9-556c207f3abf","year":2018},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:18.509959Z"},"links":{"citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:810d39c65d4d8ae469f098df6564506e0a0758770607c2bded8a0765cbcdcb7b","observation_id":"5266abc5-53db-4c43-9d78-01adbb1219d4","resolution":{"observed_at":"2026-08-07T13:02:20.099104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:02:19.832376Z","title":"Conformer: Convolution-augmented transformer for speech recognition,","venue":null,"work_id":"e2cc8483-4c21-4e80-b41e-4fc49888a161","year":2020},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:18.603771Z"},"links":{"citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:94c53c49b616c25fd31e9a3e4bc560ea001fb8618c713c8ce444e65375090c98","observation_id":"b8b9093b-ee04-4e8a-9631-764aaaf18080","resolution":{"observed_at":"2026-08-07T13:02:19.899652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:02:18.680982Z","title":"E-branchformer: Branchformer with enhanced merging for speech recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:18.680982Z"},"links":{"citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:8108eb5b8ef243052f1ac47832567f209e66ed6c0894eb868eab5877e2050782","observation_id":"ab1b22a2-46a8-4292-8e56-14defc652284","resolution":{"observed_at":"2026-08-07T13:02:18.680982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:02:19.676773Z","title":"Zipformer: A faster and better encoder for automatic speech recognition,","venue":null,"work_id":"41f7ab89-4fe1-4ca1-968e-38e6a70026b4","year":2023},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:18.774952Z"},"links":{"citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:5dcf9d13b4a1d5c8157a2b5d1b13ee5f7f1b61730af6342892bbe32d6cad379d","observation_id":"94ba7574-8dae-473b-9b36-3bbadbb79530","resolution":{"observed_at":"2026-08-07T13:02:19.744441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:02:19.535024Z","title":"Wenet: Production oriented stream- ing and non-streaming end-to-end speech recognition toolkit,","venue":null,"work_id":"71f1e2a1-9400-477f-9514-2d3c732ea707","year":2021},"citing_paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:18.872390Z"},"links":{"citing_paper":"/paper/2505.23036"},"observation_digest":"sha256:a5e39067d957fcbcec9907044345a2c156a7c5d44d935f130d2f29443f2a706d","observation_id":"fc122efd-28ac-4654-8fb2-88e3a8986677","resolution":{"observed_at":"2026-08-07T13:02:19.589643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.23036","last_updated":"2025-05-29T03:22:59Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T12:52:52.710059Z","submitted_at":"2025-05-29T03:22:59Z","title":"AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":2,"verified_fuzzy":14},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 3 inbound Pith citation observations for arXiv:2505.23036."}