{"as_of":"2026-08-08T10:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8a07b3fc574d511532d3ea29840070d60c1cee83fa118c2f27201159562a7198","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:59:46.716586Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T00:04:22.451108Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.10301","last_updated":"2024-07-29T14:52:26Z","snapshot_observed_at":"2026-08-03T15:02:48.172783Z","submitted_at":"2024-04-16T06:09:33Z","title":"Long-form music generation with latent diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10301","snapshot_observed_at":"2026-08-07T11:59:46.716586Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00927","last_updated":"2025-06-01T09:41:56Z","snapshot_observed_at":"2026-08-07T11:52:21.029687Z","submitted_at":"2025-06-01T09:41:56Z","title":"In-the-wild Audio Spatialization with Flexible Text-guided Localization","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:59:46.716586Z"},"links":{"cited_paper":"/paper/2404.10301","citing_paper":"/paper/2506.00927"},"observation_digest":"sha256:d2b48acfafd178fced68c8931d8fad167a599617b9f9350e2a377cd471a98683","observation_id":"351fe317-95a3-40ac-a656-48523bf94e57","resolution":{"observed_at":"2026-08-07T11:59:46.716586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10301","last_updated":"2024-07-29T14:52:26Z","snapshot_observed_at":"2026-08-03T15:02:48.172783Z","submitted_at":"2024-04-16T06:09:33Z","title":"Long-form music generation with latent diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10301","snapshot_observed_at":"2026-08-07T10:19:26.350553Z","title":"Long-form music generation with latent diffusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05891","last_updated":"2025-06-06T08:59:13Z","snapshot_observed_at":"2026-08-08T06:39:50.009387Z","submitted_at":"2025-06-06T08:59:13Z","title":"WAKE: Watermarking Audio with Key Enrichment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:26.350553Z"},"links":{"cited_paper":"/paper/2404.10301","citing_paper":"/paper/2506.05891"},"observation_digest":"sha256:b7baa46627c303bffa512a1e8191c6c9f75545c76f1453d37184b06f7cc3415e","observation_id":"237bc281-e6e2-478d-99bc-f3e97e626b97","resolution":{"observed_at":"2026-08-07T10:19:26.350553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10301","last_updated":"2024-07-29T14:52:26Z","snapshot_observed_at":"2026-08-03T15:02:48.172783Z","submitted_at":"2024-04-16T06:09:33Z","title":"Long-form music generation with latent diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10301","snapshot_observed_at":"2026-08-06T19:42:05.689145Z","title":"Long-form music generation with latent diffusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04864","last_updated":"2025-07-07T10:46:07Z","snapshot_observed_at":"2026-08-06T19:35:17.936165Z","submitted_at":"2025-07-07T10:46:07Z","title":"Music Boomerang: Reusing Diffusion Models for Data Augmentation and Audio Manipulation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:42:05.689145Z"},"links":{"cited_paper":"/paper/2404.10301","citing_paper":"/paper/2507.04864"},"observation_digest":"sha256:6c2505c1ff87747fc25c8fcb7ea37cd38b1f1f86130ae3171e10e1b900682aba","observation_id":"c272e73f-2a7a-487d-9aae-b8c315fdf398","resolution":{"observed_at":"2026-08-06T19:42:05.689145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10301","last_updated":"2024-07-29T14:52:26Z","snapshot_observed_at":"2026-08-03T15:02:48.172783Z","submitted_at":"2024-04-16T06:09:33Z","title":"Long-form music generation with latent diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10301","snapshot_observed_at":"2026-08-05T22:54:54.920307Z","title":"D., Carr, C., Zukowski, Z., Taylor, J., and Pons, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10924","last_updated":"2025-08-20T08:48:57Z","snapshot_observed_at":"2026-08-08T05:49:19.993515Z","submitted_at":"2025-08-08T09:03:13Z","title":"ASAudio: A Survey of Advanced Spatial Audio Research","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T22:54:54.920307Z"},"links":{"cited_paper":"/paper/2404.10301","citing_paper":"/paper/2508.10924"},"observation_digest":"sha256:e46685a3ad70089c1ead8f93d89f132d5ab1a1b251c877454ae99eb5835da3e8","observation_id":"10d9b764-8e6b-474f-819d-61db03b33a6b","resolution":{"observed_at":"2026-08-05T22:54:54.920307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10301","last_updated":"2024-07-29T14:52:26Z","snapshot_observed_at":"2026-08-03T15:02:48.172783Z","submitted_at":"2024-04-16T06:09:33Z","title":"Long-form music generation with latent diffusion","version":2},"cited_work":{"arxiv_id":"2404.10301","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.10301","snapshot_observed_at":"2026-07-08T00:04:22.451108Z","title":"Long-form music generation with latent diffusion.arXiv:2404.10301, 2024a","venue":"cs.SD","work_id":"0719335e-d066-4137-8127-ad31b0cd27aa","year":2024},"citing_paper":{"arxiv_id":"2604.01929","last_updated":"2026-04-29T10:54:09Z","snapshot_observed_at":"2026-07-06T22:51:40.181565Z","submitted_at":"2026-04-02T11:49:00Z","title":"Woosh: A Sound Effects Foundation Model","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T20:51:08.144573Z"},"links":{"cited_paper":"/paper/2404.10301","citing_paper":"/paper/2604.01929"},"observation_digest":"sha256:9a0fdfe9826b675d6b363e48ffa88e2c33f0a02e51d231e9a9fd547ed2aaaf8d","observation_id":"d630949b-9041-49c4-b6a2-89e5cf734cab","resolution":{"observed_at":"2026-05-13T20:53:15.857234Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10301","last_updated":"2024-07-29T14:52:26Z","snapshot_observed_at":"2026-08-03T15:02:48.172783Z","submitted_at":"2024-04-16T06:09:33Z","title":"Long-form music generation with latent diffusion","version":2},"cited_work":{"arxiv_id":"2404.10301","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.10301","snapshot_observed_at":"2026-07-08T00:04:22.451108Z","title":"Long-form music generation with latent diffusion.arXiv:2404.10301, 2024a","venue":"cs.SD","work_id":"0719335e-d066-4137-8127-ad31b0cd27aa","year":2024},"citing_paper":{"arxiv_id":"2605.13404","last_updated":"2026-05-13T11:59:41Z","snapshot_observed_at":"2026-08-07T10:17:55.423783Z","submitted_at":"2026-05-13T11:59:41Z","title":"Seconds-Aligned PCA-DAC Latent Diffusion for Symbolic-to-Audio Drum Rendering","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-14T18:38:43.559539Z"},"links":{"cited_paper":"/paper/2404.10301","citing_paper":"/paper/2605.13404"},"observation_digest":"sha256:40a507adeccf8f3496cd6da1907f190ec5bc44e1160eb6a0f0501bdfde131081","observation_id":"1684b2a8-9e63-471a-bbc4-f3debbe0da5b","resolution":{"observed_at":"2026-05-14T18:39:22.183244Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10301","last_updated":"2024-07-29T14:52:26Z","snapshot_observed_at":"2026-08-03T15:02:48.172783Z","submitted_at":"2024-04-16T06:09:33Z","title":"Long-form music generation with latent diffusion","version":2},"cited_work":{"arxiv_id":"2404.10301","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.10301","snapshot_observed_at":"2026-07-08T00:04:22.451108Z","title":"Long-form music generation with latent diffusion.arXiv:2404.10301, 2024a","venue":"cs.SD","work_id":"0719335e-d066-4137-8127-ad31b0cd27aa","year":2024},"citing_paper":{"arxiv_id":"2605.22717","last_updated":"2026-05-21T16:54:07Z","snapshot_observed_at":"2026-07-06T23:32:59.663926Z","submitted_at":"2026-05-21T16:54:07Z","title":"Live Music Diffusion Models: Efficient Fine-Tuning and Post-Training of Interactive Diffusion Music Generators","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T03:24:50.604019Z"},"links":{"cited_paper":"/paper/2404.10301","citing_paper":"/paper/2605.22717"},"observation_digest":"sha256:e57ca8cca3e8855b0d12ed06ed478333f8386ab434fc4d32a4b5b82989a89d38","observation_id":"180e0950-93d0-4cab-9479-d8fe8e82756b","resolution":{"observed_at":"2026-05-22T03:25:58.995820Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10301","last_updated":"2024-07-29T14:52:26Z","snapshot_observed_at":"2026-08-03T15:02:48.172783Z","submitted_at":"2024-04-16T06:09:33Z","title":"Long-form music generation with latent diffusion","version":2},"cited_work":{"arxiv_id":"2404.10301","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.10301","snapshot_observed_at":"2026-07-08T00:04:22.451108Z","title":"Long-form music generation with latent diffusion.arXiv:2404.10301, 2024a","venue":"cs.SD","work_id":"0719335e-d066-4137-8127-ad31b0cd27aa","year":2024},"citing_paper":{"arxiv_id":"2606.12555","last_updated":"2026-07-02T19:10:03Z","snapshot_observed_at":"2026-07-12T14:16:32.755376Z","submitted_at":"2026-06-10T18:06:27Z","title":"AudioX-Turbo: A Unified Framework for Efficient Anything-to-Audio Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T08:04:48.283908Z"},"links":{"cited_paper":"/paper/2404.10301","citing_paper":"/paper/2606.12555"},"observation_digest":"sha256:4e793d20b081fa7aaee43539f6226bbab9d97dd1e54d863becf2394b75dadbe7","observation_id":"71065932-b94a-463a-8a0a-5fdda690985a","resolution":{"observed_at":"2026-07-03T13:28:18.779223Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10301","last_updated":"2024-07-29T14:52:26Z","snapshot_observed_at":"2026-08-03T15:02:48.172783Z","submitted_at":"2024-04-16T06:09:33Z","title":"Long-form music generation with latent diffusion","version":2},"cited_work":{"arxiv_id":"2404.10301","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.10301","snapshot_observed_at":"2026-07-08T00:04:22.451108Z","title":"Long-form music generation with latent diffusion.arXiv:2404.10301, 2024a","venue":"cs.SD","work_id":"0719335e-d066-4137-8127-ad31b0cd27aa","year":2024},"citing_paper":{"arxiv_id":"2607.05196","last_updated":"2026-07-07T15:36:48Z","snapshot_observed_at":"2026-07-11T07:46:45.098798Z","submitted_at":"2026-07-06T15:11:57Z","title":"Unified Audio Intelligence Without Regressing on Text Intelligence","version":1},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-07-07T23:59:38.702609Z"},"links":{"cited_paper":"/paper/2404.10301","citing_paper":"/paper/2607.05196"},"observation_digest":"sha256:43c711d0202720a6380e4dfe89f818de76a55d8f1376ae8fec10263bdc168af6","observation_id":"1d69060d-9e2a-4a32-a8e5-3b446e87df76","resolution":{"observed_at":"2026-07-08T00:04:22.452391Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10301","last_updated":"2024-07-29T14:52:26Z","snapshot_observed_at":"2026-08-03T15:02:48.172783Z","submitted_at":"2024-04-16T06:09:33Z","title":"Long-form music generation with latent diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10301","snapshot_observed_at":"2026-07-11T07:46:49.059192Z","title":"arXiv preprint arXiv:2404.10301 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05196","last_updated":"2026-07-07T15:36:48Z","snapshot_observed_at":"2026-07-11T07:46:45.098798Z","submitted_at":"2026-07-06T15:11:57Z","title":"Unified Audio Intelligence Without Regressing on Text Intelligence","version":2},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-07-11T07:46:49.059192Z"},"links":{"cited_paper":"/paper/2404.10301","citing_paper":"/paper/2607.05196"},"observation_digest":"sha256:896492a832c600ffeb77db9c7dae29cd75672fba5668f8dd81bd2ca5a61987cf","observation_id":"d6a3e05c-0ad7-42ab-9d30-eb6c2525024d","resolution":{"observed_at":"2026-07-11T07:46:49.059192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10301","last_updated":"2024-07-29T14:52:26Z","snapshot_observed_at":"2026-08-03T15:02:48.172783Z","submitted_at":"2024-04-16T06:09:33Z","title":"Long-form music generation with latent diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10301","snapshot_observed_at":"2026-08-03T08:35:48.723618Z","title":"Long-form music generation with latent diffusion.arXiv preprint arXiv:2404.10301, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29363","last_updated":"2026-07-31T12:51:24Z","snapshot_observed_at":"2026-08-05T23:15:08.967026Z","submitted_at":"2026-07-31T12:51:24Z","title":"Stable Autoregressive Speech Generation with Low-Frame-Rate High-Dimensional Continuous Tokens","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T08:35:48.723618Z"},"links":{"cited_paper":"/paper/2404.10301","citing_paper":"/paper/2607.29363"},"observation_digest":"sha256:65bee216a05e1360a1b1b2143cda6d073fca836c712d03d3980925ec9f823161","observation_id":"85dbf6a9-efbb-4786-8349-a07511050edd","resolution":{"observed_at":"2026-08-03T08:35:48.723618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10301","last_updated":"2024-07-29T14:52:26Z","snapshot_observed_at":"2026-08-03T15:02:48.172783Z","submitted_at":"2024-04-16T06:09:33Z","title":"Long-form music generation with latent diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10301","snapshot_observed_at":"2026-08-05T14:08:31.796045Z","title":"Long-Form Music Generation With Latent Diffusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03721","last_updated":"2026-08-04T14:19:59Z","snapshot_observed_at":"2026-08-07T23:12:20.875539Z","submitted_at":"2026-08-04T14:19:59Z","title":"On the Geometry of Music Bandwidth Extension in Latent Spaces of Audio Codecs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T14:08:31.796045Z"},"links":{"cited_paper":"/paper/2404.10301","citing_paper":"/paper/2608.03721"},"observation_digest":"sha256:a194db864b628318b8007874fb2c7824ae4dea5fcfb46fad5a83eaacd6b63928","observation_id":"be5684af-b5ae-4839-a628-2b5371d2a9eb","resolution":{"observed_at":"2026-08-05T14:08:31.796045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10301","last_updated":"2024-07-29T14:52:26Z","snapshot_observed_at":"2026-08-03T15:02:48.172783Z","submitted_at":"2024-04-16T06:09:33Z","title":"Long-form music generation with latent diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10301","snapshot_observed_at":"2026-08-05T13:43:18.097916Z","title":"DOI 10.48550/arXiv.2404.10301","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03742","last_updated":"2026-08-04T14:36:34Z","snapshot_observed_at":"2026-08-08T01:12:36.890782Z","submitted_at":"2026-08-04T14:36:34Z","title":"AI-Based Sound Effect Generation: A Narrative Review of Generative Models Across Input Modalities","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T13:43:18.097916Z"},"links":{"cited_paper":"/paper/2404.10301","citing_paper":"/paper/2608.03742"},"observation_digest":"sha256:6cbf27fbaab2bcc9ac4f8e0fcaed5ac4faaf6dd9b0c5ec40b5fe84964bbcfd92","observation_id":"775a07d5-4098-423c-b0a6-ba1b3b538eeb","resolution":{"observed_at":"2026-08-05T13:43:18.097916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2404.10301/citation-record","integrity":"/paper/2404.10301/integrity","json":"/paper/2404.10301/citation-record.json","paper":"/paper/2404.10301"},"outbound":[],"paper":{"arxiv_id":"2404.10301","last_updated":"2024-07-29T14:52:26Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-03T15:02:48.172783Z","submitted_at":"2024-04-16T06:09:33Z","title":"Long-form music generation with latent diffusion"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2404.10301."}