Pith. sign in

Paper Citation Record · LEDGER

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation

As of 13 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2608.09571.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2608.09571 v1

Coverage vector

measured 58 of 58 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-11T14:54:55.275856Z

measured 58 of 58 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-13T06:32:02.005865+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

58 of 58 outbound references displayed

  • verified exact3
  • verified fuzzy30
  • unresolved24
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation afd02cc8-07cd-496d-a50f-5e442ff4c8c2 · outbound

This paper cites an unresolved cited work.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Unresolved cited work

Reference 1

Resolution
unresolved
raw_fallback, observed 2026-08-11T14:54:56.272037Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.028632Z digest=sha256:6241f82ca5e95f705ee93eeb95192db30662e37255d952c9787b1c52233b6f73

Observation 4eed1274-ef77-48e1-b345-c3ae0df48eb6 · outbound

This paper cites V oicebox: Text-guided multilingual universal speech generation at 8 scale.Advances in neural information processing systems, 36:14005–14034, 2023.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation V oicebox: Text-guided multilingual universal speech generation at 8 scale.Advances in neural information processing systems, 36:14005–14034, 2023

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.257290Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.033145Z digest=sha256:4a46019919ba865c225c3ec2860081f56efa9c1687191cda8068281d365199b7

Observation fb1a21ac-4182-42ba-84e7-1f03920daa17 · outbound

This paper cites F5- TTS: A fairytaler that fakes fluent and faithful speech with flow matching.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation F5- TTS: A fairytaler that fakes fluent and faithful speech with flow matching

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.242505Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.038148Z digest=sha256:1a497e04ed87d7d028bce146277c3ba5e19ff9c5d3e42c123dd222ac82852298

Observation c3e5f785-c4a8-424a-8b6e-b1cbf54b13c0 · outbound

This paper cites Tangoflux: Super fast and faithful text to audio generation with flow matching and clap-ranked preference optimization.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Tangoflux: Super fast and faithful text to audio generation with flow matching and clap-ranked preference optimization

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.228130Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.042819Z digest=sha256:b9fca49baa4fbac9362f6a4ab92648f63c76a0a61a2acf5cf96c463980a8b66d

Observation 4fa110ad-eb7a-4c90-9dca-66fc47c1d481 · outbound

This paper cites Plumbley.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Plumbley

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.212486Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.047662Z digest=sha256:8d3f0003a9899265eee90085bdb2aa7af39828fee8726b8ad335e09a5dfe1ac7

Observation c268a083-01d3-4d96-ae51-f753edf7da14 · outbound

This paper cites an unresolved cited work.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-11T14:54:56.196252Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.052640Z digest=sha256:5664c7086a70538495d05e54ad7255f0d2032d60cdb5348bb64e4acadc54ebe2

Observation cdbad638-fd23-48e1-bf05-11a5343a5750 · outbound

This paper cites Audiobox: Unified Audio Generation with Natural Language Prompts.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Audiobox: Unified Audio Generation with Natural Language Prompts

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.057843Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.057843Z digest=sha256:fd1ac793b85802e2755d278f17a144fc34c68b0e16c6334addd4dd91478aa7e1

Observation a466b657-6ca1-489c-921d-c11eb11d7be7 · outbound

This paper cites Dasheng AudioGen: A Unified Model for Generating Coherent Audio Scenes from Text.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Dasheng AudioGen: A Unified Model for Generating Coherent Audio Scenes from Text

Reference 8

Resolution
verified exact
local_arxiv, observed 2026-08-11T14:54:55.619644Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.067522Z digest=sha256:bb74ba9ab9ef178ef72d75f2b462cf70d3042fbaab7d5905894965acb602bdf8

Observation f59e3dc8-afac-4863-b9ef-1593a0f9b875 · outbound

This paper cites UniMoE-Audio: Unified speech and music generation with dynamic- capacity mixture-of-experts.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation UniMoE-Audio: Unified speech and music generation with dynamic- capacity mixture-of-experts

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.178829Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.072212Z digest=sha256:763d16cb72b0cf193e309459d7c6737cb35214f5eb68895f57a87e59ffcf87c8

Observation 8e6278e1-319a-45e0-9363-943639f4f052 · outbound

This paper cites Mandic, Wenwu Wang, and Mark D.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Mandic, Wenwu Wang, and Mark D

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.163243Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.076050Z digest=sha256:43531a5ab45b398f22e2e58a21c0efb13e8b363a42a1c4544774fc48260243e0

Observation a826b188-4b5a-4d18-bb33-6e4b0ca9c963 · outbound

This paper cites UniSonate: A unified model for speech, music, and sound effect generation with text instructions.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation UniSonate: A unified model for speech, music, and sound effect generation with text instructions

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.148464Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.079733Z digest=sha256:9b9e6f2ebd455df224b16e5d332bd4060c0c1e219e4127196d9e359a94493638

Observation 79092f9d-7ac3-4d2d-b7e0-8a2dbf9f2cda · outbound

This paper cites Make-An-Audio 2: Temporal-Enhanced Text-to-Audio Generation.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Make-An-Audio 2: Temporal-Enhanced Text-to-Audio Generation

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.083682Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.083682Z digest=sha256:e1e27b25f986776f1c8bd651699ca6daff035308e9f80109fbaa5798687c745a

Observation d82903fd-9735-4cd8-81ec-05f31fbda54c · outbound

This paper cites Text-to-audio generation using in- struction guided latent diffusion model.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Text-to-audio generation using in- struction guided latent diffusion model

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.133911Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.087986Z digest=sha256:c85fee1a90932d005592f6486d498852be97b888bcfb6cd0d620575dd06a612e

Observation 54b05279-be64-43e9-8226-51d3f4c08fac · outbound

This paper cites Freeaudio: Training-free timing plan- ning for controllable long-form text-to-audio generation.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Freeaudio: Training-free timing plan- ning for controllable long-form text-to-audio generation

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.119443Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.091787Z digest=sha256:a2de635437a829b2627a0e37b43c18e77c79de2be78cb8d599c16ce29fe1c0c5

Observation e04a2ccd-3fd9-4258-a87f-8fe0dd487153 · outbound

This paper cites Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity.Journal of Machine Learn- ing Research, 23(120):1–39, 2022.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity.Journal of Machine Learn- ing Research, 23(120):1–39, 2022

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.095477Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.095477Z digest=sha256:b9bed5e83a600b9ade4160b4319e56130273a64649a525238c121537f3788279

Observation 62964b0e-7417-4d5b-9b98-07b190c2032c · outbound

This paper cites Scaling Diffusion Transformers to 16 Billion Parameters.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Scaling Diffusion Transformers to 16 Billion Parameters

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.099279Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.099279Z digest=sha256:16f3dfb2daff699f06cde5ca7be502accf363608ce553ceb383f188d1896ced5

Observation 1ea80760-c232-497a-bed6-eb0602fcff01 · outbound

This paper cites Switch diffu- sion transformer: Synergizing denoising tasks with sparse mixture-of-experts.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Switch diffu- sion transformer: Synergizing denoising tasks with sparse mixture-of-experts

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.095129Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.103831Z digest=sha256:24e957d308f24a55da2b61663fb4c9e675f709bc2ed93fbe87649f9fbb214a7e

Observation f5509802-f7a0-46ce-8b60-2855f3ce56b7 · outbound

This paper cites EC-DIT: Scaling diffusion transformers with adaptive expert-choice routing.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation EC-DIT: Scaling diffusion transformers with adaptive expert-choice routing

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.079884Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.108164Z digest=sha256:d69e5fff96f3be9fe250d35364c17e95f39db56aed9aad2524a17952f2f453ae

Observation 91b25063-e225-4f9a-92d6-762f8998988d · outbound

This paper cites Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.113059Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.113059Z digest=sha256:98c34efe2811c91bd9f74bcdb814a696a83499a9dce76273fc10076e95efad9a

Observation 7c0ebbd6-d290-41f6-9327-a19b0d50143d · outbound

This paper cites Scalable diffusion mod- els with transformers.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Scalable diffusion mod- els with transformers

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.065225Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.117751Z digest=sha256:2893fc7092e24dbc971f9fb9b8cf32573a54d59f3d284072f328fef17e021fa1

Observation ec6c0a83-9fa1-445a-aa46-3864d9e1d3cb · outbound

This paper cites Learning transferable visual models from natural language supervision.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Learning transferable visual models from natural language supervision

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.052100Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.122187Z digest=sha256:3819c1b67aece46f929b7761c986629488f8c97b68e078656a988b30307acd37

Observation 8a2bcaef-be1c-44b5-9a36-b84fec2768e0 · outbound

This paper cites CosyVoice 2: Scalable Streaming Speech Synthesis with Large Language Models.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation CosyVoice 2: Scalable Streaming Speech Synthesis with Large Language Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.126911Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.126911Z digest=sha256:1d019a6d3b725fd78f673f15e5d12694db300150a977929c36604fc48bedfe1b

Observation 0e10443b-a2af-4cb4-9da5-27e2fbf33a07 · outbound

This paper cites Step-Audio: Unified Understanding and Generation in Intelligent Speech Interaction.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Step-Audio: Unified Understanding and Generation in Intelligent Speech Interaction

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.131781Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.131781Z digest=sha256:16642d306fa6af2252511f83460e3ec0d251bd997acd96f354220380da9a1870

Observation 0669497a-4ea5-47c6-8599-cf94c0d5df74 · outbound

This paper cites Simple and controllable music generation.Advances in neural information processing systems, 36:47704–47720, 2023.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Simple and controllable music generation.Advances in neural information processing systems, 36:47704–47720, 2023

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.038847Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.136657Z digest=sha256:15fc68eaad85312e3672a632f705c69b5e56f20f641c462ab0dd55ae6692838c

Observation ef7088ac-e0e6-4331-a5c5-bff7ee09a496 · outbound

This paper cites SegTune: Structured and fine-grained con- trol for song generation.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation SegTune: Structured and fine-grained con- trol for song generation

Reference 25

Resolution
verified exact
doi, observed 2026-08-11T14:54:55.528507Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.140918Z digest=sha256:fc1f4884facc00c96d92ba1a2785bf320dcd90b53e9c90a8612aa60a48d3a7dc

Observation a41bb708-5063-4773-a12d-b90f59ac082e · outbound

This paper cites Qwen2.5-Omni Technical Report.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Qwen2.5-Omni Technical Report

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.144842Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.144842Z digest=sha256:dc0cf961a00df8d2046898e41b006bdf04623a2f00b19373ea1e7747eea38364

Observation fda2e9ef-d7ff-4da9-a101-f60dad53afd7 · outbound

This paper cites Parker, CJ Carr, Zack Zukowski, Josiah Taylor, and Jordi Pons.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Parker, CJ Carr, Zack Zukowski, Josiah Taylor, and Jordi Pons

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.025058Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.153623Z digest=sha256:c4e52467cb469c29596276d34be46902685ce48c66287c485cc0f0e3500cbf6e

Observation 386c4899-330e-4995-a944-fd706fcd1e3d · outbound

This paper cites Audiox: A unified framework for anything-to-audio generation.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Audiox: A unified framework for anything-to-audio generation

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.010531Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.157870Z digest=sha256:45072addabf347f9af2264dbe6bca76926da75f45757943740569853187c2e67

Observation ddc464a5-37d5-489e-bdb3-37f041586904 · outbound

This paper cites Higgs Audio V2: Redefining expressiveness in audio generation.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Higgs Audio V2: Redefining expressiveness in audio generation

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.995338Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.161824Z digest=sha256:284617f80495dd475ca14317c8aa7e5e32b7e185044a81b206ec9ad4eb276fe9

Observation 4ae51aae-4b50-4398-bbf1-ffeb860a1e57 · outbound

This paper cites UniFlow- Audio: Unified flow matching for audio generation from omni-modalities.CoRR, abs/2509.24391, 2025.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation UniFlow- Audio: Unified flow matching for audio generation from omni-modalities.CoRR, abs/2509.24391, 2025

Reference 30

Resolution
verified exact
doi, observed 2026-08-11T14:54:55.499848Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.165701Z digest=sha256:d582d4bc6786b33884444d071a226e6926a99732304edc983c903d7dce8bb6ed

Observation 955e52c4-3a3b-455c-8728-ad26f9cbfee5 · outbound

This paper cites Supervised learning of universal sentence representations from natural language inference data.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Supervised learning of universal sentence representations from natural language inference data

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.169530Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.169530Z digest=sha256:352e79cc7721126355592b40a0f9072b318db7ac17f75a81cec8d34bb2c62e73

Observation abcac6ea-9023-46a7-83e5-f42822daecd6 · outbound

This paper cites Classifier-Free Diffusion Guidance.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Classifier-Free Diffusion Guidance

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.173499Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.173499Z digest=sha256:e60912afaacd2111bbaa81953a667b91f7702b336ce7d324da34e04aaa3887e5

Observation 6004f259-5b16-45c1-a7ea-f7031326e77c · outbound

This paper cites Eliminating oversaturation and artifacts of high guidance scales in diffusion models.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Eliminating oversaturation and artifacts of high guidance scales in diffusion models

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.978801Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.178905Z digest=sha256:e2e85e8d6238453b5f6194c39d2eac8715c9ee14c31640797e94ca600a79a611

Observation ac4144c2-224e-423e-9d08-114090bf528a · outbound

This paper cites Seed-TTS: A Family of High-Quality Versatile Speech Generation Models.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Seed-TTS: A Family of High-Quality Versatile Speech Generation Models

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.183277Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.183277Z digest=sha256:b3d598c417fced32141c4f67200164963a646f499f252d5cf41eebb326f9af0a

Observation 371dd502-aa54-4b93-8057-8f167f221832 · outbound

This paper cites Librispeech-pc: Benchmark for evaluation of punc- tuation and capitalization capabilities of end-to-end asr models.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Librispeech-pc: Benchmark for evaluation of punc- tuation and capitalization capabilities of end-to-end asr models

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.963729Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.188042Z digest=sha256:6ae06dbf7de411695f475a89f1090dfa41ddc51c71fb6c6e0f85da16cffe6f4c

Observation b2798beb-52d1-42af-ac10-55cdf9072415 · outbound

This paper cites AudioCaps: Generating captions for audios in the wild.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation AudioCaps: Generating captions for audios in the wild

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.948849Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.192582Z digest=sha256:d2856c0160ee59be9261931a7c54e5f0401e881cc535c9610e56182e24bf6a9c

Observation 7f6a365e-c732-4d60-b0d2-c35994108945 · outbound

This paper cites MusicLM: Generating Music From Text.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation MusicLM: Generating Music From Text

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.196931Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.196931Z digest=sha256:d86db957e6a41bd46ef1a606cb1e4524c1426df273180ebfcf11fe33fc24acee

Observation b68f9f84-a28b-4284-9d43-227b77b4bca7 · outbound

This paper cites The Song Describer Dataset: a Corpus of Audio Captions for Music-and-Language Evaluation.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation The Song Describer Dataset: a Corpus of Audio Captions for Music-and-Language Evaluation

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.201613Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.201613Z digest=sha256:11e090da603e82b720d87fa8881aff099b80114c6e528e699eba7282772a0fef

Observation 9242d031-4e69-4b04-9d86-ddf022d84c86 · outbound

This paper cites Qwen3-VL Technical Report.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Qwen3-VL Technical Report

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.206209Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.206209Z digest=sha256:3bc365b8c246eb850344ca5ca0f8cd02fff6a8c610e7cd5b46f49a0a8518743a

Observation 0cb6a07a-4fb6-4c10-b20e-18cc239d67a0 · outbound

This paper cites Robust speech recognition via large-scale weak supervision.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Robust speech recognition via large-scale weak supervision

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.935113Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.210869Z digest=sha256:53f55698366491df61d413457be9e9f455545a44522e2846cd2e09143a4b66af

Observation c7d98b08-56b2-46b5-bba9-9d43b7952fa7 · outbound

This paper cites rain” may be an event in sfx, “an urban street in a downpour.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation rain” may be an event in sfx, “an urban street in a downpour

Reference 41

Resolution
malformed identifier
raw_fallback, observed 2026-08-11T14:54:55.921565Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.215282Z digest=sha256:a3074169434ac21b5456ebc4a7279f278bbfe5006d5d2770620123257993baad

Observation f7f18d1f-6b9b-4db2-b40a-3db806700a16 · outbound

This paper cites rule-based templates.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation rule-based templates

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.907528Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.219349Z digest=sha256:9b2abcf72e4f5d477f1b4c9d028e0614445c79dd1e0ae180374a3d88febc73c0

Observation 1fa24644-4753-455f-b26b-eb41a89cd3be · outbound

This paper cites Do not include markdown, explana- tions, or extra text.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Do not include markdown, explana- tions, or extra text

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.893520Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.223346Z digest=sha256:34407be2f6497b4d764bb9e6d554a1686b8825bb7f48afaa14e1db4841dcdfc9

Observation 0010179d-e9ce-4f5e-bd02-2954138956d6 · outbound

This paper cites Do not add new keys.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Do not add new keys

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.878723Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.227851Z digest=sha256:6e93e11b9d9bb05b851a4317a1302982bf9162e0859fab37d19f51688193e656

Observation 364a779a-e06d-4041-af44-06bacacb3304 · outbound

This paper cites - Do not paraphrase, expand, or rewrite it.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation - Do not paraphrase, expand, or rewrite it

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.863503Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.231770Z digest=sha256:782e574de063fd6918e1cdcb7d18bc5f467ecf4076ba6b13310b7824491c59a6

Observation 28fde77a-e01a-4113-815d-914948893213 · outbound

This paper cites - Otherwise leave it empty.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation - Otherwise leave it empty

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.849051Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.235918Z digest=sha256:e131b17381cf5f6fbba6b265e60bc05ef22de164660d12895a21ad5370a65240

Observation 750581f5-7a9b-4b7d-be7b-b099686e335e · outbound

This paper cites Other- wise leave it empty.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Other- wise leave it empty

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.834994Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.239775Z digest=sha256:31501a8df80e1d441b2723dcbec03533667527e49534b9c8a0d313f750d2fe1c

Observation 465acee9-987c-47c6-bfc0-4dab1cd5d5c7 · outbound

This paper cites an unresolved cited work.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Unresolved cited work

Reference 50

Resolution
unresolved
raw_fallback, observed 2026-08-11T14:54:55.821099Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.243879Z digest=sha256:725a2b0058cbce2a019c6df51f5a2f3524253ade683bb1e595f919539a4c2e37

Observation ace219d6-1fef-41df-969f-24e92c3f7d29 · outbound

This paper cites - Otherwise leave it empty.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation - Otherwise leave it empty

Reference 51

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.807877Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.247581Z digest=sha256:6563e290d7d71ed45ffda84d36d2aa8f536a3dd61cda85bf4b7455e0183c22c8

Observation 353f1487-1fbf-4872-a937-cbd532615bd3 · outbound

This paper cites an unresolved cited work.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Unresolved cited work

Reference 52

Resolution
unresolved
raw_fallback, observed 2026-08-11T14:54:55.794116Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.251276Z digest=sha256:8cdc856373175c1887e36573a242dba21d8cf617e0817b1e11f641985376df08

Observation 83f9cdc4-50cd-4be2-bf37-b6357e747476 · outbound

This paper cites an unresolved cited work.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Unresolved cited work

Reference 53

Resolution
unresolved
raw_fallback, observed 2026-08-11T14:54:55.778522Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.254890Z digest=sha256:b162d4262af875b86801df3a2deb80d1ef117f73d0c34dafcdc2c71bbb8f28a8

Observation 6330a75d-ffd2-4610-a6f9-473999d3b4e5 · outbound

This paper cites an unresolved cited work.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Unresolved cited work

Reference 54

Resolution
unresolved
raw_fallback, observed 2026-08-11T14:54:55.762312Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.258634Z digest=sha256:dc921ac650b491511e1566d08d84f7aeb30065674bb97167ca7ab672de5b315c

Observation 889cc983-b815-4dd9-a3e1-56cfdcf16dad · outbound

This paper cites an unresolved cited work.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Unresolved cited work

Reference 55

Resolution
unresolved
raw_fallback, observed 2026-08-11T14:54:55.747826Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.262758Z digest=sha256:68d13f84db7249f0d4f164d20cffddfcd6708a05d0815ffd65795b86b3dc10fc

Observation 4c9b4f35-0a32-4976-af3c-7a1910d000f2 · outbound

This paper cites 1", "2",.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation 1", "2",

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.733866Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.267346Z digest=sha256:e762c4567dd21cd07ef82a1da026f0ea1904192f363bfd4fa5c7abcba4cd2d63

Observation 4038b4a8-cdc6-468c-835d-7d4d25138f2f · outbound

This paper cites an unresolved cited work.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Unresolved cited work

Reference 57

Resolution
unresolved
raw_fallback, observed 2026-08-11T14:54:55.720592Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.271550Z digest=sha256:b6ac7bc6d4014efb889d46caa60d4105e570f3cf723989992f02ac5ca07955e6

Observation 0d1a757a-e876-4dc8-b70c-6f66be8fce40 · outbound

This paper cites summary":.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation summary":

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.706330Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-11T14:54:55.275856Z digest=sha256:2a3650f0ddd2bd47841460f60fcabd87a4c97659afee3214fb8bbd5b609b271f

Observation 57e5ad33-fe50-4da2-b06f-b3c4ed53a099 · outbound

This paper cites Audiobox: Unified Audio Generation with Natural Language Prompts.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Audiobox: Unified Audio Generation with Natural Language Prompts

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.062732Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.062732Z digest=sha256:2426b0183b158cb246d93f8f56172a76b421475267fa90fdfa5888feb019a964

Observation d2ee54d8-1f0b-469a-98b8-2ae550ef66e5 · outbound

This paper cites Qwen2.5-Omni Technical Report.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Qwen2.5-Omni Technical Report

Reference 2025

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.149373Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.149373Z digest=sha256:cd334999adf8d448b3502bd4789b8aa8db225833def12c8519dd5dba5bbb883d

Pith citing papers

No inbound Pith citation observations are available.