Pith. sign in

Paper Citation Record · LEDGER

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition

As of 9 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 3 inbound Pith citation observations for arXiv:2505.23036.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.23036 v1

Coverage vector

measured 23 of 23 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:02:18.872390Z

measured 26 of 26 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 3 of 3 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:02:16.624199Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-01T20:16:12.215607Z

Reference resolution

23 of 23 outbound references displayed

  • verified exact2
  • verified fuzzy14
  • unresolved7
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 82167eed-5ce5-472e-aeae-17954c426521 · outbound

This paper cites AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T13:02:16.624199Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:02:16.624199Z digest=sha256:19f71fa37421126dfbf6a7ab190da7105b48109c6f14e61cc456c7633845fe79

Observation 3b577577-a875-4da2-83b8-c403f77b794d · outbound

This paper cites Additionally, each speaker wears a high-fidelity micro- phone to collect near-field audio for data annotation.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition Additionally, each speaker wears a high-fidelity micro- phone to collect near-field audio for data annotation

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:02:22.127061Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:02:16.737473Z digest=sha256:0555b610a1f7ab9fc74f961fc15200a6f738ecae340f6b5116bc6420d2bb59ad

Observation 092e6d19-67cf-4e4a-ae30-8bb63c608deb · outbound

This paper cites The baseline system con- sists of two primary sub-modules: speech frontend processing and automatic speech recognition (ASR).

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition The baseline system con- sists of two primary sub-modules: speech frontend processing and automatic speech recognition (ASR)

Reference 3

Resolution
verified exact
raw_fallback, observed 2026-08-07T13:02:19.424949Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:02:16.841267Z digest=sha256:51c0b027c449b8eb6fddc0b10932fcb6dca700e3672ce52af5d2b4bf0445de09

Observation 29325b22-6c87-408e-a481-0237d1e00ea6 · outbound

This paper cites AISHELL-5 is suitable for speech sep- aration, speech enhancement, noise reduction, and automatic speech recognition (ASR) tasks targeting in-car scenarios.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition AISHELL-5 is suitable for speech sep- aration, speech enhancement, noise reduction, and automatic speech recognition (ASR) tasks targeting in-car scenarios

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:02:21.902935Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:02:17.000499Z digest=sha256:6e5175ad6e46481889176b076bbda60a77013f17580e884420807348d42a483f

Observation 215e0546-d753-4933-98c7-10ae35ed5646 · outbound

This paper cites AISHELL-4: An Open Source Dataset for Speech Enhancement, Separation, Recognition and Speaker Diarization in Conference Scenario.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition AISHELL-4: An Open Source Dataset for Speech Enhancement, Separation, Recognition and Speaker Diarization in Conference Scenario

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T13:02:17.150613Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:02:17.150613Z digest=sha256:e355cce47a055b2d277030814c17266d780a6d658206cd6540171ec4f65afd56

Observation 73542d1e-0c1d-495d-8ae7-107114fd649a · outbound

This paper cites M2met: The icassp 2022 multi- channel multi-party meeting transcription challenge,.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition M2met: The icassp 2022 multi- channel multi-party meeting transcription challenge,

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:02:21.704655Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:02:17.242049Z digest=sha256:b0b1e60fd1da5365cf14690571a13ee04f6785469f25051e702a9cdd4f8acbf4

Observation fdbc0bb6-2d51-466e-966c-b009ac9d16e8 · outbound

This paper cites LibriMix: An Open-Source Dataset for Generalizable Speech Separation.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition LibriMix: An Open-Source Dataset for Generalizable Speech Separation

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T13:02:17.367614Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:02:17.367614Z digest=sha256:bbcbc3c34a9e92c7a04e9fdac6b0ed1887e3f66b3d6a2fc67db328e3f435cd9e

Observation 1dd913d0-0488-4074-ab2b-fd349777bd9c · outbound

This paper cites Lib- rispeech: An asr corpus based on public domain audio books,.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition Lib- rispeech: An asr corpus based on public domain audio books,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:02:21.515267Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:02:17.453376Z digest=sha256:c85e3a8da5ba9a826ab414fdec0a6ade0dc70c1dadcc03dd9ece32b1256507ee

Observation 2515089f-8a20-49ae-8e71-4c40962c3d9b · outbound

This paper cites WHAM!: Extending Speech Separation to Noisy Environments.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition WHAM!: Extending Speech Separation to Noisy Environments

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T13:02:17.550805Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:02:17.550805Z digest=sha256:21773138827acefc9cac09c18da339418efc3eafa7850d85cc195b4d4dfd5b98

Observation 3e14967a-12b0-46c7-9d39-4702c26907e3 · outbound

This paper cites Realistic multi-microphone data simulation for distant speech recognition.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition Realistic multi-microphone data simulation for distant speech recognition

Reference 10

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:02:19.163511Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:02:17.684377Z digest=sha256:ce967b8012e7eb3c641822599191085fd947d34781a4fc2a855b82545f9c8f76

Observation 8e8375a5-61d5-4daa-99a2-cb8c4cc3ae75 · outbound

This paper cites Effective noise-aware data simulation for domain- adaptive speech enhancement leveraging dynamic stochastic per- turbation,.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition Effective noise-aware data simulation for domain- adaptive speech enhancement leveraging dynamic stochastic per- turbation,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:02:21.290358Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:02:17.775325Z digest=sha256:db0a931860735938e1f47e617e3e41218930f5ff57f198de666c14402a7b8e17

Observation c02e67da-65bf-4d3b-8147-7c502bf516d6 · outbound

This paper cites The iscslp 2022 intelligent cock- pit speech recognition challenge (icsrc): Dataset, tracks, baseline and results,.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition The iscslp 2022 intelligent cock- pit speech recognition challenge (icsrc): Dataset, tracks, baseline and results,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:02:21.088237Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:02:17.859859Z digest=sha256:75783c359e2830524f3d257d9e74efb5960767d8a65806c9e8d56032b3bc9707

Observation 87077904-6367-4ef6-a4d3-c31f08a9eca2 · outbound

This paper cites ICMC-ASR: the ICASSP 2024 in-car multi- channel automatic speech recognition challenge,.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition ICMC-ASR: the ICASSP 2024 in-car multi- channel automatic speech recognition challenge,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:02:20.912275Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:02:17.966522Z digest=sha256:7001294e060d8217394090ab778d761b0e1075c816e254140c29dab418923bd6

Observation deb3863a-1491-4473-8536-1231dd394702 · outbound

This paper cites Paraformer: Fast and accurate parallel transformer for non-autoregressive end-to- end speech recognition,.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition Paraformer: Fast and accurate parallel transformer for non-autoregressive end-to- end speech recognition,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:02:20.702220Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:02:18.070056Z digest=sha256:be6c70ab6a324c9080c638afd97cedfdb4fc7809da48e54f07226d7442c0c055

Observation dadd2573-9f62-4dde-a78a-ede398f3adcd · outbound

This paper cites Robust speech recognition via large-scale weak su- pervision,.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition Robust speech recognition via large-scale weak su- pervision,

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T13:02:18.145296Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:02:18.145296Z digest=sha256:91db3bf871b4a159fb6cdf061790840fff976f3361e3eb6c5b8f59189d2ce692

Observation 8a7c6960-92a5-4066-8d93-2bae2534e090 · outbound

This paper cites Funaudiollm: V oice understanding and genera- tion foundation models for natural interaction between humans and llms,.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition Funaudiollm: V oice understanding and genera- tion foundation models for natural interaction between humans and llms,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:02:20.480466Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:02:18.226968Z digest=sha256:765f07fdaa7e140b44b3e4d985f036a28377b4eb370770899049811afe6acfb5

Observation 2a3172ab-101e-4eb6-9e0a-678652c7d356 · outbound

This paper cites Qwen2-Audio Technical Report.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition Qwen2-Audio Technical Report

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T13:02:18.317706Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:02:18.317706Z digest=sha256:aadb88eff67ebcaa905ffb0e91a111a61beaea2e78ca95b9ee74fb978df8ce2d

Observation 505e2d5a-11b0-425f-bf6f-34df8a30cbe2 · outbound

This paper cites Independent vector analysis: An extension of ICA to multivariate components,.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition Independent vector analysis: An extension of ICA to multivariate components,

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:02:20.286774Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:02:18.415591Z digest=sha256:4dea845c48a56dd3afb2b69208809c8ed4d7fd82b459f5a7c1c63bd47e1a5f54

Observation 5266abc5-53db-4c43-9d78-01adbb1219d4 · outbound

This paper cites Speech-transformer: A no- recurrence sequence-to-sequence model for speech recognition,.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition Speech-transformer: A no- recurrence sequence-to-sequence model for speech recognition,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:02:20.099104Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:02:18.509959Z digest=sha256:b829cad944dcffd73378f48f8900ad8c864ba3ebaae9e8495a057a9bba0e9cb3

Observation b8b9093b-ee04-4e8a-9631-764aaaf18080 · outbound

This paper cites Conformer: Convolution-augmented transformer for speech recognition,.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition Conformer: Convolution-augmented transformer for speech recognition,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:02:19.899652Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:02:18.603771Z digest=sha256:86d5bfd7ea6879557e6cd42e66de34b9625e051080db7637b07123160f002931

Observation ab1b22a2-46a8-4292-8e56-14defc652284 · outbound

This paper cites E-branchformer: Branchformer with enhanced merging for speech recognition,.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition E-branchformer: Branchformer with enhanced merging for speech recognition,

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T13:02:18.680982Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:02:18.680982Z digest=sha256:8108eb5b8ef243052f1ac47832567f209e66ed6c0894eb868eab5877e2050782

Observation 94ba7574-8dae-473b-9b36-3bbadbb79530 · outbound

This paper cites Zipformer: A faster and better encoder for automatic speech recognition,.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition Zipformer: A faster and better encoder for automatic speech recognition,

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:02:19.744441Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:02:18.774952Z digest=sha256:037f6747961e45064b2ad8b3dcd3caade58bcb51870f6dc588b84688e5a8395a

Observation fc122efd-28ac-4654-8fb2-88e3a8986677 · outbound

This paper cites Wenet: Production oriented stream- ing and non-streaming end-to-end speech recognition toolkit,.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition Wenet: Production oriented stream- ing and non-streaming end-to-end speech recognition toolkit,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:02:19.589643Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:02:18.872390Z digest=sha256:115c0ab117004a73fa191528e87b35753d731f6f8118c76a9a4d6f9da412fca1

Pith citing papers

Observation 82167eed-5ce5-472e-aeae-17954c426521 · inbound

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition cites this paper.

AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T13:02:16.624199Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:02:16.624199Z digest=sha256:19f71fa37421126dfbf6a7ab190da7105b48109c6f14e61cc456c7633845fe79

Observation cf7d77ba-97f9-413c-a2c0-bed1d9187391 · inbound

Non-Intrusive Automatic Speech Recognition Refinement: A Survey cites this paper.

Non-Intrusive Automatic Speech Recognition Refinement: A Survey AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition

Reference 167

Resolution
verified exact
arxiv_id, observed 2026-05-21T23:35:45.906902Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-21T23:34:52.249143Z digest=sha256:5674acb10e10140c44daf4a4627edf261022ee06c96dac1045e96adca3a19fc1

Observation d3548ec0-aed3-4855-8934-4fd9c98a649c · inbound

A Unified and Reproducible Experimentation Framework for Speech Understanding cites this paper.

A Unified and Reproducible Experimentation Framework for Speech Understanding AISHELL-5: The First Open-Source In-Car Multi-Channel Multi-Speaker Speech Dataset for Automatic Speech Diarization and Recognition

Reference 28

Resolution
verified exact
arxiv_id, observed 2026-07-01T20:16:12.217425Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-06-28T21:20:16.428207Z digest=sha256:d2875d3b3f1d82fa2d4aa7a3b36b593b6317862e6e7fca5bb7fba232d9593591