Pith. sign in

Paper Citation Record · LEDGER

Phoneme-First Prediction for LLM-Based Speech Recognition

As of 1 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2606.10864.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2606.10864 v1

Coverage vector

measured 41 of 41 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-06-27T11:50:03.947364Z

measured 41 of 41 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-01T06:32:01.292127+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

41 of 41 outbound references displayed

  • verified exact1
  • verified fuzzy0
  • unresolved40
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation d1b14169-4b35-4c45-8544-e5f89945c72f · outbound

This paper cites Hybrid CTC/Attention architecture for end-to- end speech recognition,.

Phoneme-First Prediction for LLM-Based Speech Recognition Hybrid CTC/Attention architecture for end-to- end speech recognition,

Reference 1

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:56aab7f709fce18c2bcb4b04949ace60c43e3e784dd8b48846df7eb0fa4a8526

Observation 6b01d563-b780-4530-b8d2-e70c5c4481db · outbound

This paper cites Robust speech recognition via large-scale weak supervision,.

Phoneme-First Prediction for LLM-Based Speech Recognition Robust speech recognition via large-scale weak supervision,

Reference 2

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:9d3035e2dd8e552de301add1232da81f4e9841f7f9d2d319345fe52dbcf7115f

Observation e1db1406-605b-43c8-a94d-8a2c6faa10cd · outbound

This paper cites Reproducing Whisper-style training using an open- source toolkit and publicly available data,.

Phoneme-First Prediction for LLM-Based Speech Recognition Reproducing Whisper-style training using an open- source toolkit and publicly available data,

Reference 3

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:722ada0d67a27c77602c25c5e1e1012f236ea2e17073cff64acb650826686074

Observation 669d07a2-23b5-487f-ad7d-b8b78af9ab28 · outbound

This paper cites Wav2vec 2.0: A framework for self-supervised learning of speech representations,.

Phoneme-First Prediction for LLM-Based Speech Recognition Wav2vec 2.0: A framework for self-supervised learning of speech representations,

Reference 4

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:63f5ac8d168e35c6b0c4c70af5aec152eec649034daabecdadf15aa70aa5779a

Observation 986f3fd8-9c41-46e4-9dbb-f71a4806f83d · outbound

This paper cites HuBERT: Self-supervised speech representation learning by masked prediction of hidden units,.

Phoneme-First Prediction for LLM-Based Speech Recognition HuBERT: Self-supervised speech representation learning by masked prediction of hidden units,

Reference 5

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:c64e7a9785fc4af6bc771ec65bbbe4d1b3a0d5184f858be99a67e302f3403965

Observation 04e42d85-8d14-46d5-bd4a-9f700843e86b · outbound

This paper cites Language models are few-shot learners,.

Phoneme-First Prediction for LLM-Based Speech Recognition Language models are few-shot learners,

Reference 6

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:c09d89ac525378160f946cec202fa234b8e6a9eca5b55f91d6fed162771d8e31

Observation 992fab96-0548-4444-932c-5eac8b18f3ab · outbound

This paper cites ICLEval: Evaluating in-context learning ability of large language models,.

Phoneme-First Prediction for LLM-Based Speech Recognition ICLEval: Evaluating in-context learning ability of large language models,

Reference 7

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:4e0da7411bc32ea7abc007cb892b8639dee060f71f2070c8c804c35d6dcde30c

Observation 1b6710c4-8ada-4492-82e0-4abca001297a · outbound

This paper cites AudioChatLlama: Towards general-purpose speech abilities for LLMs,.

Phoneme-First Prediction for LLM-Based Speech Recognition AudioChatLlama: Towards general-purpose speech abilities for LLMs,

Reference 8

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:ecb4564d88f480a72efbb9bbf6f414145300aaab611809cbf68639f6fb5431ba

Observation 9a2f510a-899c-42b2-a92a-38338f8b3f75 · outbound

This paper cites Prompting large language models with speech recognition abilities,.

Phoneme-First Prediction for LLM-Based Speech Recognition Prompting large language models with speech recognition abilities,

Reference 9

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:2cbed8f4cd5d359752ae2fe783858ab7a69db8dd1447696237e81f8a65ec9865

Observation ddf5143e-c500-4292-ac28-174acafe8bff · outbound

This paper cites SALMONN: Towards generic hearing abilities for large language models,.

Phoneme-First Prediction for LLM-Based Speech Recognition SALMONN: Towards generic hearing abilities for large language models,

Reference 10

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:192250b4a839218e58026cad43315a4c0fd2639d57e447e21e3ee694eacb8906

Observation 53be9f38-2b91-475f-b8bc-f9a32fcf2d5a · outbound

This paper cites On decoder-only architecture for speech-to-text and large language model integration,.

Phoneme-First Prediction for LLM-Based Speech Recognition On decoder-only architecture for speech-to-text and large language model integration,

Reference 11

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:31a5e783a00dba16fd56d11bebcfcc25a65b76e41166f2a8bead39fd9958a1f4

Observation e5656288-7fba-4200-8c70-4f65b25316db · outbound

This paper cites Wav2Prompt: End-to-end speech prompt learning and task-based fine-tuning for text-based LLMs,.

Phoneme-First Prediction for LLM-Based Speech Recognition Wav2Prompt: End-to-end speech prompt learning and task-based fine-tuning for text-based LLMs,

Reference 12

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:aba446727967b44cd062d0b35a5f8e4a83d38e70d19bebf439f1173e47ed04fb

Observation 0b8865ce-2074-48db-8f6e-c578995019b6 · outbound

This paper cites Speech ReaLLM: Real-time speech recognition with multimodal language models by teaching the flow of time,.

Phoneme-First Prediction for LLM-Based Speech Recognition Speech ReaLLM: Real-time speech recognition with multimodal language models by teaching the flow of time,

Reference 13

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:a930d7d00b4fefe0bf058f70a64d463a4ff8d17bf4b66bace9a05014ddcbbca7

Observation 09d58f6b-d535-4145-87bc-754bb56ae523 · outbound

This paper cites SALM: Speech-augmented language model with in-context learning for speech recognition and translation,.

Phoneme-First Prediction for LLM-Based Speech Recognition SALM: Speech-augmented language model with in-context learning for speech recognition and translation,

Reference 14

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:33d7716eff87fef7a3573f8c4f782f70e446a249d29348fa6b2837152157b29f

Observation 93153887-f10e-4eb3-8b8e-95ff650fa62e · outbound

This paper cites Investigating decoder-only large language models for speech-to-text translation,.

Phoneme-First Prediction for LLM-Based Speech Recognition Investigating decoder-only large language models for speech-to-text translation,

Reference 15

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:eb4962383ab0d94c0aebc8fedc44587aa7ffe20c8d12fd39aa110efa71beabf7

Observation 7e5de177-0799-46ec-a724-2e35eb519400 · outbound

This paper cites Prompting large language models with audio for general-purpose speech summarization,.

Phoneme-First Prediction for LLM-Based Speech Recognition Prompting large language models with audio for general-purpose speech summarization,

Reference 16

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:616c7951f20279b416df7d41b9d7c79bd02c89dba2827b92d16dbff1f7508d40

Observation df4b2ca7-7ecd-4176-ad0d-0b21386aaf62 · outbound

This paper cites Contextual biasing speech recognition in speech- enhanced large language model,.

Phoneme-First Prediction for LLM-Based Speech Recognition Contextual biasing speech recognition in speech- enhanced large language model,

Reference 17

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:053ee1e198a6a43b88b16b8b3c93eef395b7c2e0625fe838d4e254b751d33fb3

Observation 36704c65-2420-4a0c-a8cb-ec950f86c00f · outbound

This paper cites MaLa-ASR: Multimedia-assisted LLM-based ASR,.

Phoneme-First Prediction for LLM-Based Speech Recognition MaLa-ASR: Multimedia-assisted LLM-based ASR,

Reference 18

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:808a92194d787f7151d9dfdd492512cf4f0c984162ceb13e7b4916e6a0831a59

Observation a54408b2-a99b-4b86-a9e1-2c66c8191eb1 · outbound

This paper cites SpeechGPT: Empowering large language models with intrinsic cross-modal conversational abilities,.

Phoneme-First Prediction for LLM-Based Speech Recognition SpeechGPT: Empowering large language models with intrinsic cross-modal conversational abilities,

Reference 19

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:d896f79afe43a1ccbc9c4898d4f97c40cc3c42cf5880f5a034e28c5a43e0fb12

Observation 284b0de5-918a-404f-9c31-6d890f22f798 · outbound

This paper cites Using large language model for end-to-end Chinese ASR and NER,.

Phoneme-First Prediction for LLM-Based Speech Recognition Using large language model for end-to-end Chinese ASR and NER,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:61f7703fd5e984373c5c098a537c4a345b327335bfb395ada784b5f75530dc99

Observation 83509249-a515-4525-b1cf-39a88a4c44f4 · outbound

This paper cites Whispering LLaMA: A cross-modal generative error correction framework for speech recognition,.

Phoneme-First Prediction for LLM-Based Speech Recognition Whispering LLaMA: A cross-modal generative error correction framework for speech recognition,

Reference 21

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:05c44c6f1d1ac08ba6af21ee0c75a7091c11e2f392b27f7ed232f784b6f6a554

Observation 308dcc7e-753a-4e69-9279-90908678973a · outbound

This paper cites SLM: Bridge the thin gap between speech and text foundation models,.

Phoneme-First Prediction for LLM-Based Speech Recognition SLM: Bridge the thin gap between speech and text foundation models,

Reference 22

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:bf9f224b3675b19fb6ca0fc124d021be6bdee2344085c0ded381e78c846a719b

Observation 0ef9b052-c03a-4603-bc7b-067531d782cd · outbound

This paper cites Connecting speech encoder and large language model for ASR,.

Phoneme-First Prediction for LLM-Based Speech Recognition Connecting speech encoder and large language model for ASR,

Reference 23

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:57070740ba3ca88c3d881415eb25a11e1b326eafd922530c17bdb73d0e40b153

Observation 8104caaf-e607-4bbb-bff9-2edd8952fe6c · outbound

This paper cites Speech recognition meets large language model: Benchmarking, models, and exploration,.

Phoneme-First Prediction for LLM-Based Speech Recognition Speech recognition meets large language model: Benchmarking, models, and exploration,

Reference 24

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:1611b6be537d9257286c2e05a61f6134e33c59e3e9f83fa6b75cd1eb27ac963c

Observation 2118fe69-6661-4f4f-b71d-3f4584908b88 · outbound

This paper cites Improving spoken language modeling with phoneme classification: A simple fine-tuning approach,.

Phoneme-First Prediction for LLM-Based Speech Recognition Improving spoken language modeling with phoneme classification: A simple fine-tuning approach,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:a4ce5b6a32527e61fb4faea4e50b89e564c4c55031bcbe1528b732a826ed958e

Observation cd7db311-2d99-4413-ae0a-4b4b24da9145 · outbound

This paper cites Improving large-scale deep biasing with phoneme features and text-only data in streaming transducer,.

Phoneme-First Prediction for LLM-Based Speech Recognition Improving large-scale deep biasing with phoneme features and text-only data in streaming transducer,

Reference 26

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:cbd74e06247e8834f878d305a698abb3b8e5e578d4799fe7f97d0b1e3e192d86

Observation 6297b633-bdeb-4f11-8f8a-7d709a229f9b · outbound

This paper cites Phoneme-aware encoding for prefix-tree-based contextual asr,.

Phoneme-First Prediction for LLM-Based Speech Recognition Phoneme-aware encoding for prefix-tree-based contextual asr,

Reference 27

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:0bffcb2a05b1fb48e48f951c64f8fce299bf65f74a48a290f4a5a1e4e3bcbcaa

Observation cf51188d-07bb-454e-b1ee-08920e00827c · outbound

This paper cites WavLLM: Towards robust and adaptive speech large language model,.

Phoneme-First Prediction for LLM-Based Speech Recognition WavLLM: Towards robust and adaptive speech large language model,

Reference 28

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:01c1d4edafbe7ba9a580559f8f3bd0557fffdf790990253ff4a1cb5c5fd7c70d

Observation bbc33d70-9477-4bdd-915f-5130d293ceef · outbound

This paper cites AlignFormer: Modality matching can achieve better zero-shot instruction-following speech-LLM,.

Phoneme-First Prediction for LLM-Based Speech Recognition AlignFormer: Modality matching can achieve better zero-shot instruction-following speech-LLM,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:6e0a7e6b37b7493f9be7700301cac388a4db3dd88a0652f6744c3fd901add3ea

Observation ab3def8d-3cf8-419b-8428-2fee0b2640fe · outbound

This paper cites QLoRA: Efficient finetuning of quantized LLMs,.

Phoneme-First Prediction for LLM-Based Speech Recognition QLoRA: Efficient finetuning of quantized LLMs,

Reference 30

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:54c13663dcdeaab5fcac6c768a57bcdbb87a86e82cc403b8046ccf0987e41a04

Observation f33e143b-118a-4a18-a01b-8699a69ff287 · outbound

This paper cites Speech model pre-training for end-to-end spoken language understanding,.

Phoneme-First Prediction for LLM-Based Speech Recognition Speech model pre-training for end-to-end spoken language understanding,

Reference 31

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:a7167634ff12e293a5d22181f71565c4077490a7b5cc74a0f416ee7713bbdacb

Observation 824d3fce-3840-4767-a90b-3331137371d9 · outbound

This paper cites TED-LIUM 3: Twice as much data and corpus repartition for experiments on speaker adaptation,.

Phoneme-First Prediction for LLM-Based Speech Recognition TED-LIUM 3: Twice as much data and corpus repartition for experiments on speaker adaptation,

Reference 32

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:4e73f4fd901861980c267cecfbff9ca63ce27e6c9b1a60222ac22485205661f5

Observation 58fa854f-d45e-42d8-bd71-f1277dff0ee1 · outbound

This paper cites TED-LIUM: an automatic speech recognition dedicated corpus,.

Phoneme-First Prediction for LLM-Based Speech Recognition TED-LIUM: an automatic speech recognition dedicated corpus,

Reference 33

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:9665b1cec0febc3007acd6d91f58d0707435e6ce5998bebcd188a401ee2fc82b

Observation 1978b4ab-abaf-4dca-902c-bbdbccba3c10 · outbound

This paper cites Layer-wise analysis of a self-supervised speech representation model,.

Phoneme-First Prediction for LLM-Based Speech Recognition Layer-wise analysis of a self-supervised speech representation model,

Reference 34

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:48eeb7f626d6e2a8e32dcd0e4ad06fd835f9af7502e5c71edfdce34a5f349317

Observation 15f6a2eb-8be1-4f7e-ad30-5e48f197f1a6 · outbound

This paper cites SUPERB: Speech processing universal PERfor- mance benchmark,.

Phoneme-First Prediction for LLM-Based Speech Recognition SUPERB: Speech processing universal PERfor- mance benchmark,

Reference 35

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:22728199c0ee63cf849507d1d82d33a27b127369a3a5e093d4ea86b76d6f2e62

Observation a4d18cae-9b84-4b3c-aad9-0b18a3a40c0d · outbound

This paper cites The Spoken Dutch Corpus: Overview and first evaluation,.

Phoneme-First Prediction for LLM-Based Speech Recognition The Spoken Dutch Corpus: Overview and first evaluation,

Reference 36

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:242d216b50eb0f8367ddcaa97339a2dafeb243ea7d44b672512d2a24539e3716

Observation b79553a2-623e-482b-838a-fe44156eeb26 · outbound

This paper cites Automatic generation of phonetic transcriptions for large speech corpora,.

Phoneme-First Prediction for LLM-Based Speech Recognition Automatic generation of phonetic transcriptions for large speech corpora,

Reference 37

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:9a005c3c5c16645590509929de70c7e883d09161189ce8b083fa6f16185a62d1

Observation 28860d14-9775-4695-8545-8b7daa61a088 · outbound

This paper cites Assessing manually corrected broad phonetic transcriptions in the spoken Dutch corpus,.

Phoneme-First Prediction for LLM-Based Speech Recognition Assessing manually corrected broad phonetic transcriptions in the spoken Dutch corpus,

Reference 38

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:fc782054609f2b40e62659dda755e60eea5eed190fbeaf742c6491ee28e8d283

Observation 1689d178-78d0-42b0-b4b4-48f29e61a808 · outbound

This paper cites Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling.

Phoneme-First Prediction for LLM-Based Speech Recognition Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling

Reference 39

Resolution
verified exact
arxiv_id, observed 2026-07-03T07:47:44.606826Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:18904b4408d52fb195246efe6cb869a933f264a5a713ca47508890d9131a8e70

Observation 0fc1c09f-bcf6-4dd7-926b-0975430163ce · outbound

This paper cites Trans-tokenization and cross-lingual vocabulary transfers: language adaptation of LLMs for low-resource NLP,.

Phoneme-First Prediction for LLM-Based Speech Recognition Trans-tokenization and cross-lingual vocabulary transfers: language adaptation of LLMs for low-resource NLP,

Reference 40

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:524c23e00ba58186c60e53f1216393723add409f1f526dba83e79cdd39122f9d

Observation 2e9ebee1-5cad-42cd-8cab-f9446785a2fe · outbound

This paper cites Montreal Forced Aligner: Trainable text- speech alignment using Kaldi,.

Phoneme-First Prediction for LLM-Based Speech Recognition Montreal Forced Aligner: Trainable text- speech alignment using Kaldi,

Reference 41

Resolution
unresolved
no resolver link, observed 2026-06-27T11:50:03.947364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T11:50:03.947364Z digest=sha256:f7118e53922864a7f51264dc0c8e5170e51d9d84146413f2c9f16dc7a9ea5dea

Pith citing papers

No inbound Pith citation observations are available.