Pith. sign in

Paper Citation Record · LEDGER

Fast Timing-Conditioned Latent Audio Diffusion

As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2402.04825.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2402.04825 v3

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 14 of 14 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 14 of 14 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-08T17:54:22.891858Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-03T03:37:36.031809Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation fc99a626-6e4a-4c66-bb16-89f32f61809e · inbound

dKV-Cache: The Cache for Diffusion Language Models cites this paper.

dKV-Cache: The Cache for Diffusion Language Models Fast Timing-Conditioned Latent Audio Diffusion

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T15:17:07.900441Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:17:07.900441Z digest=sha256:6e8d60ba368724a33ded79795b6e1976d97326ba66e7b12b86346941eb797481

Observation 1e7d39c1-f7c2-4423-9784-068546702900 · inbound

AI-Generated Song Detection via Lyrics Transcripts cites this paper.

AI-Generated Song Detection via Lyrics Transcripts Fast Timing-Conditioned Latent Audio Diffusion

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-06T23:21:30.499711Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:21:30.499711Z digest=sha256:65da796abd8d26bcac02ec23884e18afd2fb823ff780297b91aeadfee7315000

Observation 2da10804-5f78-4332-b841-100ce0bb964d · inbound

MuseControlLite: Multifunctional Music Generation with Lightweight Conditioners cites this paper.

MuseControlLite: Multifunctional Music Generation with Lightweight Conditioners Fast Timing-Conditioned Latent Audio Diffusion

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-06T23:19:50.536482Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:19:50.536482Z digest=sha256:af40e14a20e547af60ba71b095a1272e8ab8e0c5fbb117b7ad73291f8c16613a

Observation cd05d04f-bdfb-47f3-90e8-829559e48630 · inbound

Hear-Your-Click: Interactive Object-Specific Video-to-Audio Generation cites this paper.

Hear-Your-Click: Interactive Object-Specific Video-to-Audio Generation Fast Timing-Conditioned Latent Audio Diffusion

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-06T19:39:53.274224Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:39:53.274224Z digest=sha256:5ca2a5c85e120cd9cdef2ec494267f968ceeaf505d84a12688922dc4114d6147

Observation fb7fc861-e8fa-4c79-a6fd-53f57b73239f · inbound

CLEAR: Continuous Latent Autoregressive Modeling for High-quality and Low-latency Speech Synthesis cites this paper.

CLEAR: Continuous Latent Autoregressive Modeling for High-quality and Low-latency Speech Synthesis Fast Timing-Conditioned Latent Audio Diffusion

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-05T16:01:52.581625Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T16:01:52.581625Z digest=sha256:a7d3838e88bf7ad7164ccd38b1fd18673d7c7c631c6bafec9b5ff83435a52e70

Observation b87501ec-c7f3-4220-a049-8c11ab0f676b · inbound

Omni2Sound: Towards Unified Video-Text-to-Audio Generation cites this paper.

Omni2Sound: Towards Unified Video-Text-to-Audio Generation Fast Timing-Conditioned Latent Audio Diffusion

Reference 33

Resolution
metadata mismatch
arxiv_id, observed 2026-05-16T17:28:10.008157Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-16T17:25:38.591071Z digest=sha256:cd16f6fc67d6cc336ea8e40bc84a685a18ff043cc0819b6a26d42f60ce0ffce9

Observation 78a13d46-e7e3-494a-a5c5-8818dff1d07b · inbound

Woosh: A Sound Effects Foundation Model cites this paper.

Woosh: A Sound Effects Foundation Model Fast Timing-Conditioned Latent Audio Diffusion

Reference 2

Resolution
verified exact
arxiv_id, observed 2026-05-13T20:53:15.852159Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-13T20:51:08.144573Z digest=sha256:b86b273017a5d6a7c0e1b059d57b781edb06bbfe6659db34c24f249cec31c1d5

Observation 588d1d86-7f4d-429a-b17b-266e68eddcc1 · inbound

Diffusion Domain Expansion: Learning to Coordinate Pre-trained Diffusion Models cites this paper.

Diffusion Domain Expansion: Learning to Coordinate Pre-trained Diffusion Models Fast Timing-Conditioned Latent Audio Diffusion

Reference 37

Resolution
verified exact
arxiv_id, observed 2026-05-25T04:45:20.272666Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-05-25T04:42:42.564679Z digest=sha256:0cff788d7e6ca799b251814329c8ed6355b6dd65d0a0c3b2c91bf7808f1224d7

Observation 5948aad0-f958-4daa-9422-98c41a893690 · inbound

Entropy as a Structural Prior: How a Log-Barrier on DiT Belief Space Drives Musical Diversity and Development cites this paper.

Entropy as a Structural Prior: How a Log-Barrier on DiT Belief Space Drives Musical Diversity and Development Fast Timing-Conditioned Latent Audio Diffusion

Reference 4

Resolution
metadata mismatch
arxiv_id, observed 2026-07-02T19:57:20.272058Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-06-27T21:06:45.886467Z digest=sha256:8f5aded4c829e3e9fb297249b3417a0ef79aad3c0fcc1d3fd134cedd7c165c8b

Observation a4a215e1-a2a8-4513-9676-b6135b66641a · inbound

Inside the Latent Flow: Causal Deciphering of Attention Dynamics in Audio Separation Foundation Models cites this paper.

Inside the Latent Flow: Causal Deciphering of Attention Dynamics in Audio Separation Foundation Models Fast Timing-Conditioned Latent Audio Diffusion

Reference 52

Resolution
metadata mismatch
arxiv_id, observed 2026-07-03T03:37:36.033208Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-06-27T14:58:27.176375Z digest=sha256:989d9a99a83d09138a780a8b79646f1300afcbbaad9acea4b4e8683314a0349c

Observation 9c10627d-05b8-484f-8fdf-1a4fa845ef6d · inbound

How Do Diffusion Classifiers Decide? A Bias-Centric Evaluation cites this paper.

How Do Diffusion Classifiers Decide? A Bias-Centric Evaluation Fast Timing-Conditioned Latent Audio Diffusion

Reference 7

Resolution
unresolved
no resolver link, observed 2026-07-11T23:39:16.487501Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-11T23:39:16.487501Z digest=sha256:cce5e1a8526573561962a0bc83f9ab32e768ab86c14bdf38296f01be46ad0202

Observation 966eadf5-85b5-4600-9fc7-cc92cfe6f410 · inbound

OmniVAE: An Audio-Video VAE with Cross-Modal Alignment for Joint Generation cites this paper.

OmniVAE: An Audio-Video VAE with Cross-Modal Alignment for Joint Generation Fast Timing-Conditioned Latent Audio Diffusion

Reference 23

Resolution
unresolved
no resolver link, observed 2026-07-30T10:35:00.720377Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T10:35:00.720377Z digest=sha256:1530b94a7bf43d20b839b7938cbc621fa2a44415753bfb3d0a08cfedf1fd9a6b

Observation 78d88f69-da67-4d9b-8c79-b72340a512e1 · inbound

OmniVAE: An Audio-Video VAE with Cross-Modal Alignment for Joint Generation cites this paper.

OmniVAE: An Audio-Video VAE with Cross-Modal Alignment for Joint Generation Fast Timing-Conditioned Latent Audio Diffusion

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-03T01:50:59.120923Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T01:50:59.120923Z digest=sha256:9ee64366d556009b31a854de540650cf281ff665a95ae93b41fb6b1e113c0bf4

Observation ae39f69c-a169-4759-b809-9e29a31f997f · inbound

Diff-Symbo: Text-Controlled Long-Duration Symbolic Music Generation Using Autoregressive Latent Diffusion Model cites this paper.

Diff-Symbo: Text-Controlled Long-Duration Symbolic Music Generation Using Autoregressive Latent Diffusion Model Fast Timing-Conditioned Latent Audio Diffusion

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-08T17:54:22.891858Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T17:54:22.891858Z digest=sha256:20bc4f9e336706339d16823f19973dcb5a8eeff3ffb33627aaf859d901053d09