Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links
Paper Citation Record · LEDGER
As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 33 inbound Pith citation observations for arXiv:2308.16692.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-05T06:32:48.257954+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links, observed 2026-08-05T23:10:56.208858Z
A source-named dated measurement, never combined with another source.
Source: pith, observed 2026-07-07T14:53:55.714650Z
0 of 0 outbound references displayed
External citation measurements
No source-named external measurement is stored.
No outbound reference observations are available for this paper version.
Observation 21e2559e-71e2-448e-bb54-2fb2d8744e75 · inbound
F5-TTS: A Fairytaler that Fakes Fluent and Faithful Speech with Flow Matching SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 154
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.
Observation 2e2cc775-94ec-4211-bae6-f0d509600162 · inbound
Step-Audio 2 Technical Report SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 84
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.
Observation cdd5867a-8a93-41d2-8127-0046701c044a · inbound
NanoCodec: Towards High-Quality Ultra Fast Speech LLM Inference SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 7
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 684daa38-e47c-4732-a064-d44c3ff5fe60 · inbound
LLaSO: A Foundational Framework for Reproducible Research in Large Language and Speech Model SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 93
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e89c1e01-398a-4a9b-9a5f-14c3a259b39d · inbound
Speech Discrete Tokens or Continuous Features? A Comparative Analysis for Spoken Language Understanding in SpeechLLMs SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 55
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 93203482-b7d1-49f0-8ed7-7fd2812cbe20 · inbound
CodecBench: A Comprehensive Benchmark for Acoustic and Semantic Evaluation SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 26
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a03d558c-6c2f-4275-ae38-8bca8cd10ad5 · inbound
Entropy-based Coarse and Compressed Semantic Speech Representation Learning SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 35
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b986fc34-f565-4f28-9bb0-aabbcd94cffc · inbound
FireRedTTS-2: Towards Long Conversational Speech Generation for Podcast and Chatbot SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 24
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 6177a395-c42e-4f7b-b2fb-c50277146890 · inbound
AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 51
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9d390e1d-3709-4354-a1b9-ec425eae07b5 · inbound
DeCodec: Rethinking Audio Codecs as Universal Disentangled Representation Learners SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 23
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ecdb9f2c-8b5f-49f5-bbe0-5e3761476c3c · inbound
StableToken: A Noise-Robust Semantic Speech Tokenizer for Resilient SpeechLLMs SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 91
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.
Observation 2bb80f16-9c37-465a-99cd-ffcb0690091c · inbound
TokenChain: A Discrete Speech Chain via Semantic Token Modeling SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 15
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.
Observation f011e8c3-3f3c-4f07-ba68-6169a9ff7206 · inbound
Two-Dimensional Quantization for Geometry-Aware Audio Coding SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 82
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.
Observation d8ad6aef-1f0e-4aa5-884c-4211e7627d5a · inbound
The Equalizer: Introducing Shape-Gain Decomposition in Neural Audio Codecs SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 32
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e4018985-962f-4df1-b8a7-6b4f0df66bfe · inbound
PolySLGen: Online Multimodal Speaking-Listening Reaction Generation in Polyadic Interaction SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 93
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.
Observation 975d0b7c-3b6e-4e31-82c1-c4cbdca5aa29 · inbound
PairAlign: A Framework for Sequence Tokenization via Self-Alignment with Applications to Audio Tokenization SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 61
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.
Observation 3564f7f5-83ee-4660-b759-e14212cc3e07 · inbound
PairAlign: A Framework for Sequence Tokenization via Self-Alignment with Applications to Audio Tokenization SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 61
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.
Observation 60910e39-7b60-4175-b555-72b61816971e · inbound
Codec-Robust Attacks on Audio LLMs SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 56
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.
Observation c8bbad41-00b6-47b5-964b-2cba9831453e · inbound
Codec-Robust Attacks on Audio LLMs SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 56
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.
Observation c02b7ec1-3b85-4b62-a36a-ec76c0345d7d · inbound
MOSS-Audio Technical Report SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 61
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.
Observation eff99e53-30ad-4c4e-878f-8128b51cdd53 · inbound
SARA: A Dual-Stream VAE for High-Fidelity Speech Generation via Integrating Semantic and Acoustic Representations SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 11
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.
Observation 42b92062-9349-4acb-b6c3-969097fda026 · inbound
Which Speech Representation Better Matches Text-Native Reasoning? A Study of Speech-Text Alignment on Frame Rate and Representation SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 25
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.
Observation b17b94d4-8972-4347-89f2-5dd1c4b9e824 · inbound
Self-Guidance: Enhancing Neural Codecs via Decoder Manifold Alignment SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 86
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.
Observation 01ed80dd-013b-4107-b3ea-114674aa9bb4 · inbound
Phonemes to the Rescue: Multilingual Tokenization Based on International Phonetic Alphabet SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 69
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.
Observation 6a9700a0-a430-4ac4-9502-98329c5e74fd · inbound
wav2tok 2.0: Scalable Audio Tokenization Maintaining Explicit Pairwise Token Alignment for Efficient Audio Retrieval SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 29
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.
Observation 28b4c19e-f21e-4c70-9bc7-ab4db1393272 · inbound
FlexiSLM: A Dynamic and Controllable Frame Rate Spoken Language Model SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 193
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.
Observation e6451e05-4307-47ec-9477-f9e7730f820b · inbound
SPEARBench: A Benchmark for Naturalness Evaluation in Streaming Speech-to-Speech Language Models SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 19
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.
Observation 706dcea2-3cce-4293-8aa2-6facee4b7f77 · inbound
AuEmoChat: Authentic Emotion Understanding and Rendering for Conversational Speech Synthesis SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 50
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 704dae48-2532-4840-ace5-216e89f6dfbc · inbound
AuEmoChat: Authentic Emotion Understanding and Rendering for Conversational Speech Synthesis SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 56
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation dac67f1b-7032-41fc-801a-e19e4c436218 · inbound
HARP: Harmonic-Aware Residual Partitioning for Neural Audio Codecs SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 21
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 5ae0cf21-b0fb-4649-bef0-5810607e3b1c · inbound
Investigating Codec-Internal Latent Audio Watermarking for Neural Codec Robustness SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 9
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a54b8c01-8f04-4c63-8591-12d3120f4b7f · inbound
OmniVAE: An Audio-Video VAE with Cross-Modal Alignment for Joint Generation SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 4
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 184be546-ffba-4adf-86ec-b83c1e6b6403 · inbound
OmniVAE: An Audio-Video VAE with Cross-Modal Alignment for Joint Generation SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
Reference 4
Source-reported events for the cited work
Unavailable: canonical work link unavailable.