{"as_of":"2026-08-09T05:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:948668fe8346b61607450562790217da287c59b1fd234296581577607f0d1dad","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:54:22.891858Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T03:37:36.031809Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.04825","last_updated":"2024-05-13T14:05:00Z","snapshot_observed_at":"2026-08-07T16:14:25.577993Z","submitted_at":"2024-02-07T13:23:25Z","title":"Fast Timing-Conditioned Latent Audio Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04825","snapshot_observed_at":"2026-08-07T15:17:07.900441Z","title":"Hawley, and Jordi Pons","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-07T15:09:37.600857Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:07.900441Z"},"links":{"cited_paper":"/paper/2402.04825","citing_paper":"/paper/2505.15781"},"observation_digest":"sha256:6e8d60ba368724a33ded79795b6e1976d97326ba66e7b12b86346941eb797481","observation_id":"fc99a626-6e4a-4c66-bb16-89f32f61809e","resolution":{"observed_at":"2026-08-07T15:17:07.900441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04825","last_updated":"2024-05-13T14:05:00Z","snapshot_observed_at":"2026-08-07T16:14:25.577993Z","submitted_at":"2024-02-07T13:23:25Z","title":"Fast Timing-Conditioned Latent Audio Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04825","snapshot_observed_at":"2026-08-06T23:21:30.499711Z","title":"Fast timing-conditioned latent audio diffusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18488","last_updated":"2025-06-28T05:44:41Z","snapshot_observed_at":"2026-08-06T23:13:34.347241Z","submitted_at":"2025-06-23T10:42:50Z","title":"AI-Generated Song Detection via Lyrics Transcripts","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:30.499711Z"},"links":{"cited_paper":"/paper/2402.04825","citing_paper":"/paper/2506.18488"},"observation_digest":"sha256:65da796abd8d26bcac02ec23884e18afd2fb823ff780297b91aeadfee7315000","observation_id":"1e7d39c1-f7c2-4423-9784-068546702900","resolution":{"observed_at":"2026-08-06T23:21:30.499711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04825","last_updated":"2024-05-13T14:05:00Z","snapshot_observed_at":"2026-08-07T16:14:25.577993Z","submitted_at":"2024-02-07T13:23:25Z","title":"Fast Timing-Conditioned Latent Audio Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04825","snapshot_observed_at":"2026-08-06T23:19:50.536482Z","title":"H., and Pons, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18729","last_updated":"2025-06-24T15:53:56Z","snapshot_observed_at":"2026-08-09T03:28:24.359031Z","submitted_at":"2025-06-23T15:08:03Z","title":"MuseControlLite: Multifunctional Music Generation with Lightweight Conditioners","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:19:50.536482Z"},"links":{"cited_paper":"/paper/2402.04825","citing_paper":"/paper/2506.18729"},"observation_digest":"sha256:af40e14a20e547af60ba71b095a1272e8ab8e0c5fbb117b7ad73291f8c16613a","observation_id":"2da10804-5f78-4332-b841-100ce0bb964d","resolution":{"observed_at":"2026-08-06T23:19:50.536482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04825","last_updated":"2024-05-13T14:05:00Z","snapshot_observed_at":"2026-08-07T16:14:25.577993Z","submitted_at":"2024-02-07T13:23:25Z","title":"Fast Timing-Conditioned Latent Audio Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04825","snapshot_observed_at":"2026-08-06T19:39:53.274224Z","title":"arXiv preprint arXiv:2402.04825 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04959","last_updated":"2025-07-13T09:31:19Z","snapshot_observed_at":"2026-08-07T10:47:44.341783Z","submitted_at":"2025-07-07T13:01:50Z","title":"Hear-Your-Click: Interactive Object-Specific Video-to-Audio Generation","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:53.274224Z"},"links":{"cited_paper":"/paper/2402.04825","citing_paper":"/paper/2507.04959"},"observation_digest":"sha256:5ca2a5c85e120cd9cdef2ec494267f968ceeaf505d84a12688922dc4114d6147","observation_id":"cd05d04f-bdfb-47f3-90e8-829559e48630","resolution":{"observed_at":"2026-08-06T19:39:53.274224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04825","last_updated":"2024-05-13T14:05:00Z","snapshot_observed_at":"2026-08-07T16:14:25.577993Z","submitted_at":"2024-02-07T13:23:25Z","title":"Fast Timing-Conditioned Latent Audio Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04825","snapshot_observed_at":"2026-08-05T16:01:52.581625Z","title":"Hawley, and Jordi Pons","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19098","last_updated":"2025-08-26T14:59:30Z","snapshot_observed_at":"2026-08-06T21:25:08.912503Z","submitted_at":"2025-08-26T14:59:30Z","title":"CLEAR: Continuous Latent Autoregressive Modeling for High-quality and Low-latency Speech Synthesis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T16:01:52.581625Z"},"links":{"cited_paper":"/paper/2402.04825","citing_paper":"/paper/2508.19098"},"observation_digest":"sha256:a7d3838e88bf7ad7164ccd38b1fd18673d7c7c631c6bafec9b5ff83435a52e70","observation_id":"fb7fc861-e8fa-4c79-a6fd-53f57b73239f","resolution":{"observed_at":"2026-08-05T16:01:52.581625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04825","last_updated":"2024-05-13T14:05:00Z","snapshot_observed_at":"2026-08-07T16:14:25.577993Z","submitted_at":"2024-02-07T13:23:25Z","title":"Fast Timing-Conditioned Latent Audio Diffusion","version":3},"cited_work":{"arxiv_id":"2402.04825","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04825","snapshot_observed_at":"2026-07-03T03:37:36.031809Z","title":"arXiv preprint arXiv:2402.04825 , year=","venue":null,"work_id":"11e92f45-c916-45ac-ad78-45e1874ff993","year":2024},"citing_paper":{"arxiv_id":"2601.02731","last_updated":"2026-04-29T02:44:11Z","snapshot_observed_at":"2026-07-06T22:40:46.465095Z","submitted_at":"2026-01-06T05:49:41Z","title":"Omni2Sound: Towards Unified Video-Text-to-Audio Generation","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T17:25:38.591071Z"},"links":{"cited_paper":"/paper/2402.04825","citing_paper":"/paper/2601.02731"},"observation_digest":"sha256:cd16f6fc67d6cc336ea8e40bc84a685a18ff043cc0819b6a26d42f60ce0ffce9","observation_id":"b87501ec-c7f3-4220-a049-8c11ab0f676b","resolution":{"observed_at":"2026-05-16T17:28:10.008157Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04825","last_updated":"2024-05-13T14:05:00Z","snapshot_observed_at":"2026-08-07T16:14:25.577993Z","submitted_at":"2024-02-07T13:23:25Z","title":"Fast Timing-Conditioned Latent Audio Diffusion","version":3},"cited_work":{"arxiv_id":"2402.04825","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04825","snapshot_observed_at":"2026-07-03T03:37:36.031809Z","title":"arXiv preprint arXiv:2402.04825 , year=","venue":null,"work_id":"11e92f45-c916-45ac-ad78-45e1874ff993","year":2024},"citing_paper":{"arxiv_id":"2604.01929","last_updated":"2026-04-29T10:54:09Z","snapshot_observed_at":"2026-07-06T22:51:40.181565Z","submitted_at":"2026-04-02T11:49:00Z","title":"Woosh: A Sound Effects Foundation Model","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T20:51:08.144573Z"},"links":{"cited_paper":"/paper/2402.04825","citing_paper":"/paper/2604.01929"},"observation_digest":"sha256:b86b273017a5d6a7c0e1b059d57b781edb06bbfe6659db34c24f249cec31c1d5","observation_id":"78a13d46-e7e3-494a-a5c5-8818dff1d07b","resolution":{"observed_at":"2026-05-13T20:53:15.852159Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04825","last_updated":"2024-05-13T14:05:00Z","snapshot_observed_at":"2026-08-07T16:14:25.577993Z","submitted_at":"2024-02-07T13:23:25Z","title":"Fast Timing-Conditioned Latent Audio Diffusion","version":3},"cited_work":{"arxiv_id":"2402.04825","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04825","snapshot_observed_at":"2026-07-03T03:37:36.031809Z","title":"arXiv preprint arXiv:2402.04825 , year=","venue":null,"work_id":"11e92f45-c916-45ac-ad78-45e1874ff993","year":2024},"citing_paper":{"arxiv_id":"2605.23275","last_updated":"2026-05-22T06:29:04Z","snapshot_observed_at":"2026-07-06T23:33:29.550551Z","submitted_at":"2026-05-22T06:29:04Z","title":"Diffusion Domain Expansion: Learning to Coordinate Pre-trained Diffusion Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-25T04:42:42.564679Z"},"links":{"cited_paper":"/paper/2402.04825","citing_paper":"/paper/2605.23275"},"observation_digest":"sha256:0cff788d7e6ca799b251814329c8ed6355b6dd65d0a0c3b2c91bf7808f1224d7","observation_id":"588d1d86-7f4d-429a-b17b-266e68eddcc1","resolution":{"observed_at":"2026-05-25T04:45:20.272666Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04825","last_updated":"2024-05-13T14:05:00Z","snapshot_observed_at":"2026-08-07T16:14:25.577993Z","submitted_at":"2024-02-07T13:23:25Z","title":"Fast Timing-Conditioned Latent Audio Diffusion","version":3},"cited_work":{"arxiv_id":"2402.04825","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04825","snapshot_observed_at":"2026-07-03T03:37:36.031809Z","title":"arXiv preprint arXiv:2402.04825 , year=","venue":null,"work_id":"11e92f45-c916-45ac-ad78-45e1874ff993","year":2024},"citing_paper":{"arxiv_id":"2606.07207","last_updated":"2026-06-05T12:19:00Z","snapshot_observed_at":"2026-08-03T23:58:51.636454Z","submitted_at":"2026-06-05T12:19:00Z","title":"Entropy as a Structural Prior: How a Log-Barrier on DiT Belief Space Drives Musical Diversity and Development","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T21:06:45.886467Z"},"links":{"cited_paper":"/paper/2402.04825","citing_paper":"/paper/2606.07207"},"observation_digest":"sha256:8f5aded4c829e3e9fb297249b3417a0ef79aad3c0fcc1d3fd134cedd7c165c8b","observation_id":"5948aad0-f958-4daa-9422-98c41a893690","resolution":{"observed_at":"2026-07-02T19:57:20.272058Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04825","last_updated":"2024-05-13T14:05:00Z","snapshot_observed_at":"2026-08-07T16:14:25.577993Z","submitted_at":"2024-02-07T13:23:25Z","title":"Fast Timing-Conditioned Latent Audio Diffusion","version":3},"cited_work":{"arxiv_id":"2402.04825","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04825","snapshot_observed_at":"2026-07-03T03:37:36.031809Z","title":"arXiv preprint arXiv:2402.04825 , year=","venue":null,"work_id":"11e92f45-c916-45ac-ad78-45e1874ff993","year":2024},"citing_paper":{"arxiv_id":"2606.10046","last_updated":"2026-06-10T16:28:45Z","snapshot_observed_at":"2026-08-05T07:13:46.298081Z","submitted_at":"2026-06-08T18:18:28Z","title":"Inside the Latent Flow: Causal Deciphering of Attention Dynamics in Audio Separation Foundation Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-27T14:58:27.176375Z"},"links":{"cited_paper":"/paper/2402.04825","citing_paper":"/paper/2606.10046"},"observation_digest":"sha256:989d9a99a83d09138a780a8b79646f1300afcbbaad9acea4b4e8683314a0349c","observation_id":"a4a215e1-a2a8-4513-9676-b6135b66641a","resolution":{"observed_at":"2026-07-03T03:37:36.033208Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04825","last_updated":"2024-05-13T14:05:00Z","snapshot_observed_at":"2026-08-07T16:14:25.577993Z","submitted_at":"2024-02-07T13:23:25Z","title":"Fast Timing-Conditioned Latent Audio Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04825","snapshot_observed_at":"2026-07-11T23:39:16.487501Z","title":"Hawley, and Jordi Pons","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03831","last_updated":"2026-07-04T11:35:04Z","snapshot_observed_at":"2026-08-07T22:16:15.786847Z","submitted_at":"2026-07-04T11:35:04Z","title":"How Do Diffusion Classifiers Decide? A Bias-Centric Evaluation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-11T23:39:16.487501Z"},"links":{"cited_paper":"/paper/2402.04825","citing_paper":"/paper/2607.03831"},"observation_digest":"sha256:cce5e1a8526573561962a0bc83f9ab32e768ab86c14bdf38296f01be46ad0202","observation_id":"9c10627d-05b8-484f-8fdf-1a4fa845ef6d","resolution":{"observed_at":"2026-07-11T23:39:16.487501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04825","last_updated":"2024-05-13T14:05:00Z","snapshot_observed_at":"2026-08-07T16:14:25.577993Z","submitted_at":"2024-02-07T13:23:25Z","title":"Fast Timing-Conditioned Latent Audio Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04825","snapshot_observed_at":"2026-07-30T10:35:00.720377Z","title":"Hawley, and Jordi Pons","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23855","last_updated":"2026-07-31T15:34:14Z","snapshot_observed_at":"2026-08-08T08:33:39.848789Z","submitted_at":"2026-07-26T21:51:28Z","title":"OmniVAE: An Audio-Video VAE with Cross-Modal Alignment for Joint Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-30T10:35:00.720377Z"},"links":{"cited_paper":"/paper/2402.04825","citing_paper":"/paper/2607.23855"},"observation_digest":"sha256:1530b94a7bf43d20b839b7938cbc621fa2a44415753bfb3d0a08cfedf1fd9a6b","observation_id":"966eadf5-85b5-4600-9fc7-cc92cfe6f410","resolution":{"observed_at":"2026-07-30T10:35:00.720377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04825","last_updated":"2024-05-13T14:05:00Z","snapshot_observed_at":"2026-08-07T16:14:25.577993Z","submitted_at":"2024-02-07T13:23:25Z","title":"Fast Timing-Conditioned Latent Audio Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04825","snapshot_observed_at":"2026-08-03T01:50:59.120923Z","title":"Hawley, and Jordi Pons","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23855","last_updated":"2026-07-31T15:34:14Z","snapshot_observed_at":"2026-08-08T08:33:39.848789Z","submitted_at":"2026-07-26T21:51:28Z","title":"OmniVAE: An Audio-Video VAE with Cross-Modal Alignment for Joint Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T01:50:59.120923Z"},"links":{"cited_paper":"/paper/2402.04825","citing_paper":"/paper/2607.23855"},"observation_digest":"sha256:9ee64366d556009b31a854de540650cf281ff665a95ae93b41fb6b1e113c0bf4","observation_id":"78d88f69-da67-4d9b-8c79-b72340a512e1","resolution":{"observed_at":"2026-08-03T01:50:59.120923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04825","last_updated":"2024-05-13T14:05:00Z","snapshot_observed_at":"2026-08-07T16:14:25.577993Z","submitted_at":"2024-02-07T13:23:25Z","title":"Fast Timing-Conditioned Latent Audio Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04825","snapshot_observed_at":"2026-08-08T17:54:22.891858Z","title":"InICASSP 2023-2023 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), 1–5","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05222","last_updated":"2026-08-05T11:03:33Z","snapshot_observed_at":"2026-08-09T04:10:29.851465Z","submitted_at":"2026-08-05T11:03:33Z","title":"Diff-Symbo: Text-Controlled Long-Duration Symbolic Music Generation Using Autoregressive Latent Diffusion Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T17:54:22.891858Z"},"links":{"cited_paper":"/paper/2402.04825","citing_paper":"/paper/2608.05222"},"observation_digest":"sha256:0d4e927a58c200174e2270f7920f13789edb1c41b61c226e79c36594f987c404","observation_id":"ae39f69c-a169-4759-b809-9e29a31f997f","resolution":{"observed_at":"2026-08-08T17:54:22.891858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.04825/citation-record","integrity":"/paper/2402.04825/integrity","json":"/paper/2402.04825/citation-record.json","paper":"/paper/2402.04825"},"outbound":[],"paper":{"arxiv_id":"2402.04825","last_updated":"2024-05-13T14:05:00Z","latest_version":3,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T16:14:25.577993Z","submitted_at":"2024-02-07T13:23:25Z","title":"Fast Timing-Conditioned Latent Audio Diffusion"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2402.04825."}