{"as_of":"2026-08-10T03:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cfdbd36d83485856761de19dc176367951da037aaeb432282a71710fe6a73986","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T05:10:54.426435Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T18:40:02.617633Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2301.11757","last_updated":"2023-10-23T20:47:30Z","snapshot_observed_at":"2026-07-06T14:45:19.481734Z","submitted_at":"2023-01-27T14:52:53Z","title":"Mo\\^usai: Text-to-Music Generation with Long-Context Latent Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11757","snapshot_observed_at":"2026-08-09T05:10:54.426435Z","title":"Musai: text-to-music generation with long-context latent diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03332","last_updated":"2025-02-05T16:26:06Z","snapshot_observed_at":"2026-08-09T16:41:11.317205Z","submitted_at":"2025-02-05T16:26:06Z","title":"A Mixture-Based Framework for Guiding Diffusion Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T05:10:54.426435Z"},"links":{"cited_paper":"/paper/2301.11757","citing_paper":"/paper/2502.03332"},"observation_digest":"sha256:1edb5a10135d591f187093d9a99bc6e088c594eb45feaecd973469118f7aa8ec","observation_id":"84eeedd7-ff1e-4e5d-80e0-6e27b4b00300","resolution":{"observed_at":"2026-08-09T05:10:54.426435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11757","last_updated":"2023-10-23T20:47:30Z","snapshot_observed_at":"2026-07-06T14:45:19.481734Z","submitted_at":"2023-01-27T14:52:53Z","title":"Mo\\^usai: Text-to-Music Generation with Long-Context Latent Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11757","snapshot_observed_at":"2026-08-07T00:49:43.294050Z","title":"Mo\\ˆ usai: Text-to-music generation with long-context latent diffusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12573","last_updated":"2025-06-27T22:16:16Z","snapshot_observed_at":"2026-08-09T18:41:46.611854Z","submitted_at":"2025-06-14T16:58:42Z","title":"Video-Guided Text-to-Music Generation Using Public Domain Movie Collections","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:49:43.294050Z"},"links":{"cited_paper":"/paper/2301.11757","citing_paper":"/paper/2506.12573"},"observation_digest":"sha256:e8c921a1046e298f41b55249a8b0c190975ae20b9cfd5372f04085a95426ff98","observation_id":"ff44a7fe-ccb8-437f-a06d-699d6dba7156","resolution":{"observed_at":"2026-08-07T00:49:43.294050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11757","last_updated":"2023-10-23T20:47:30Z","snapshot_observed_at":"2026-07-06T14:45:19.481734Z","submitted_at":"2023-01-27T14:52:53Z","title":"Mo\\^usai: Text-to-Music Generation with Long-Context Latent Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11757","snapshot_observed_at":"2026-08-07T04:46:03.210288Z","title":"Mo usai: Text -to- Music Generation with Long - Context Latent Diffusion , October 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01022","last_updated":"2025-06-11T13:07:47Z","snapshot_observed_at":"2026-08-09T18:00:35.042393Z","submitted_at":"2025-06-11T13:07:47Z","title":"Workflow-Based Evaluation of Music Generation Systems","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-07T04:46:03.210288Z"},"links":{"cited_paper":"/paper/2301.11757","citing_paper":"/paper/2507.01022"},"observation_digest":"sha256:9fecbeeb95ed96ff2078b93cc2e288dc5e53a2ca412f89807ff03449c611dca6","observation_id":"9ad5f04a-c543-44cc-a666-8205046bf801","resolution":{"observed_at":"2026-08-07T04:46:03.210288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11757","last_updated":"2023-10-23T20:47:30Z","snapshot_observed_at":"2026-07-06T14:45:19.481734Z","submitted_at":"2023-01-27T14:52:53Z","title":"Mo\\^usai: Text-to-Music Generation with Long-Context Latent Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11757","snapshot_observed_at":"2026-08-06T20:09:33.784073Z","title":"Moûsai: Text-to-music generation with long-context latent diffusion,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.03599","last_updated":"2025-07-04T14:12:19Z","snapshot_observed_at":"2026-08-09T23:41:06.010955Z","submitted_at":"2025-07-04T14:12:19Z","title":"MusGO: A Community-Driven Framework For Assessing Openness in Music-Generative AI","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T20:09:33.784073Z"},"links":{"cited_paper":"/paper/2301.11757","citing_paper":"/paper/2507.03599"},"observation_digest":"sha256:5d104f099a90b417729965dbcb8f863523a894b25c024e8e300561272bd265ff","observation_id":"df3c97d4-6d6a-4031-b7aa-65e4edf87a47","resolution":{"observed_at":"2026-08-06T20:09:33.784073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11757","last_updated":"2023-10-23T20:47:30Z","snapshot_observed_at":"2026-07-06T14:45:19.481734Z","submitted_at":"2023-01-27T14:52:53Z","title":"Mo\\^usai: Text-to-Music Generation with Long-Context Latent Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11757","snapshot_observed_at":"2026-08-06T11:22:27.053403Z","title":"Mo \\ˆ usai: Text-to-music generation with long-context latent diffusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22746","last_updated":"2025-08-01T03:37:42Z","snapshot_observed_at":"2026-08-06T13:36:59.117683Z","submitted_at":"2025-07-30T15:03:36Z","title":"Next Tokens Denoising for Speech Synthesis","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T11:22:27.053403Z"},"links":{"cited_paper":"/paper/2301.11757","citing_paper":"/paper/2507.22746"},"observation_digest":"sha256:a3d2487f76915df952a15cb420de47093ad2ac2b742e43481996e01663de7385","observation_id":"d123e31a-3705-44d4-864b-225d16ba3970","resolution":{"observed_at":"2026-08-06T11:22:27.053403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11757","last_updated":"2023-10-23T20:47:30Z","snapshot_observed_at":"2026-07-06T14:45:19.481734Z","submitted_at":"2023-01-27T14:52:53Z","title":"Mo\\^usai: Text-to-Music Generation with Long-Context Latent Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11757","snapshot_observed_at":"2026-08-05T22:54:55.254611Z","title":"Mo \\^ usai: Text-to-music generation with long-context latent diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10924","last_updated":"2025-08-20T08:48:57Z","snapshot_observed_at":"2026-08-08T05:49:19.993515Z","submitted_at":"2025-08-08T09:03:13Z","title":"ASAudio: A Survey of Advanced Spatial Audio Research","version":2},"reference_index":154,"source":"arxiv_source","source_observed_at":"2026-08-05T22:54:55.254611Z"},"links":{"cited_paper":"/paper/2301.11757","citing_paper":"/paper/2508.10924"},"observation_digest":"sha256:c023d8f18cc4cce96cdf942b0babef12eabc5ccb9300f4fbc465bdd88483f862","observation_id":"617096c4-e36e-4a98-bc00-c2155cbfa842","resolution":{"observed_at":"2026-08-05T22:54:55.254611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11757","last_updated":"2023-10-23T20:47:30Z","snapshot_observed_at":"2026-07-06T14:45:19.481734Z","submitted_at":"2023-01-27T14:52:53Z","title":"Mo\\^usai: Text-to-Music Generation with Long-Context Latent Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11757","snapshot_observed_at":"2026-08-04T18:41:39.605708Z","title":"Mo\\^usai: Text-to-Music Generation with Long-Context Latent Diffusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09836","last_updated":"2025-09-11T20:31:18Z","snapshot_observed_at":"2026-08-10T00:43:55.273674Z","submitted_at":"2025-09-11T20:31:18Z","title":"CoDiCodec: Unifying Continuous and Discrete Compressed Representations of Audio","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T18:41:39.605708Z"},"links":{"cited_paper":"/paper/2301.11757","citing_paper":"/paper/2509.09836"},"observation_digest":"sha256:80312878903f2d54874d58a868c6fd2d69ed6d4ac66ed8043847747cb1ade631","observation_id":"d75f4ee2-877b-44f7-ad2b-5d255600af2d","resolution":{"observed_at":"2026-08-04T18:41:39.605708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11757","last_updated":"2023-10-23T20:47:30Z","snapshot_observed_at":"2026-07-06T14:45:19.481734Z","submitted_at":"2023-01-27T14:52:53Z","title":"Mo\\^usai: Text-to-Music Generation with Long-Context Latent Diffusion","version":3},"cited_work":{"arxiv_id":"2301.11757","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2301.11757","snapshot_observed_at":"2026-07-04T18:40:02.617633Z","title":"Mo \\^ usai: Text-to-music generation with long-context latent diffusion","venue":null,"work_id":"b5fd8917-0866-4e0f-b8e3-3a4947a5cfe1","year":2023},"citing_paper":{"arxiv_id":"2509.23727","last_updated":"2026-04-09T14:19:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-28T08:12:43Z","title":"AudioMoG: Guiding Audio Generation with Mixture-of-Guidance","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-18T13:10:18.700497Z"},"links":{"cited_paper":"/paper/2301.11757","citing_paper":"/paper/2509.23727"},"observation_digest":"sha256:efcc4da9def2e390fba3cd2fec7177558c2d07e2b00fcf37ebd077199b5a4074","observation_id":"dcd21e07-2051-4675-a944-4ea174227dff","resolution":{"observed_at":"2026-05-18T13:11:23.753882Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11757","last_updated":"2023-10-23T20:47:30Z","snapshot_observed_at":"2026-07-06T14:45:19.481734Z","submitted_at":"2023-01-27T14:52:53Z","title":"Mo\\^usai: Text-to-Music Generation with Long-Context Latent Diffusion","version":3},"cited_work":{"arxiv_id":"2301.11757","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2301.11757","snapshot_observed_at":"2026-07-04T18:40:02.617633Z","title":"Mo \\^ usai: Text-to-music generation with long-context latent diffusion","venue":null,"work_id":"b5fd8917-0866-4e0f-b8e3-3a4947a5cfe1","year":2023},"citing_paper":{"arxiv_id":"2605.10203","last_updated":"2026-05-11T08:49:26Z","snapshot_observed_at":"2026-07-29T20:41:29.988615Z","submitted_at":"2026-05-11T08:49:26Z","title":"Polyphonia: Zero-Shot Timbre Transfer in Polyphonic Music with Acoustic-Informed Attention Calibration","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-12T05:15:55.193062Z"},"links":{"cited_paper":"/paper/2301.11757","citing_paper":"/paper/2605.10203"},"observation_digest":"sha256:7fe3742adc117e05d51ac2b62eeb14e31a5ce38454bf138a216b888f46c33cea","observation_id":"30b41339-3a6d-4389-ba93-4a4c4bc2efad","resolution":{"observed_at":"2026-05-12T05:16:24.161813Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11757","last_updated":"2023-10-23T20:47:30Z","snapshot_observed_at":"2026-07-06T14:45:19.481734Z","submitted_at":"2023-01-27T14:52:53Z","title":"Mo\\^usai: Text-to-Music Generation with Long-Context Latent Diffusion","version":3},"cited_work":{"arxiv_id":"2301.11757","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2301.11757","snapshot_observed_at":"2026-07-04T18:40:02.617633Z","title":"Mo \\^ usai: Text-to-music generation with long-context latent diffusion","venue":null,"work_id":"b5fd8917-0866-4e0f-b8e3-3a4947a5cfe1","year":2023},"citing_paper":{"arxiv_id":"2606.24087","last_updated":"2026-06-23T03:04:53Z","snapshot_observed_at":"2026-07-06T23:58:44.541819Z","submitted_at":"2026-06-23T03:04:53Z","title":"NeuroSonic: Conditional Flow Matching for EEG-to-Speech Reconstruction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T00:54:40.558481Z"},"links":{"cited_paper":"/paper/2301.11757","citing_paper":"/paper/2606.24087"},"observation_digest":"sha256:d1083f45b8f17e059b03dc76bd89066e0a18c09feac1f2927c60ff1a2a39c14e","observation_id":"08a49aa1-cd25-4881-acbd-56a72f33ee35","resolution":{"observed_at":"2026-07-04T16:09:57.125626Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11757","last_updated":"2023-10-23T20:47:30Z","snapshot_observed_at":"2026-07-06T14:45:19.481734Z","submitted_at":"2023-01-27T14:52:53Z","title":"Mo\\^usai: Text-to-Music Generation with Long-Context Latent Diffusion","version":3},"cited_work":{"arxiv_id":"2301.11757","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2301.11757","snapshot_observed_at":"2026-07-04T18:40:02.617633Z","title":"Mo \\^ usai: Text-to-music generation with long-context latent diffusion","venue":null,"work_id":"b5fd8917-0866-4e0f-b8e3-3a4947a5cfe1","year":2023},"citing_paper":{"arxiv_id":"2606.24307","last_updated":"2026-06-23T08:37:15Z","snapshot_observed_at":"2026-08-09T15:35:25.968156Z","submitted_at":"2026-06-23T08:37:15Z","title":"Real-Time Interactive Music Generation via Data-Free Streaming Consistency Distillation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-25T22:42:57.448084Z"},"links":{"cited_paper":"/paper/2301.11757","citing_paper":"/paper/2606.24307"},"observation_digest":"sha256:85b4d9bc9b17c4007c9e7731f08de62ba93e2f6255f6a15f277e78456ec2ad28","observation_id":"e52a930b-d5da-4cd2-8a60-0c73a90b1815","resolution":{"observed_at":"2026-07-04T18:40:02.619422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11757","last_updated":"2023-10-23T20:47:30Z","snapshot_observed_at":"2026-07-06T14:45:19.481734Z","submitted_at":"2023-01-27T14:52:53Z","title":"Mo\\^usai: Text-to-Music Generation with Long-Context Latent Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11757","snapshot_observed_at":"2026-07-14T10:59:22.914974Z","title":"Moûsai: Text-to-music genera- tion with long-context latent diffusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10537","last_updated":"2026-07-12T02:40:27Z","snapshot_observed_at":"2026-08-07T16:13:53.605999Z","submitted_at":"2026-07-12T02:40:27Z","title":"Dance to Music Generation leveraging Pre-training with Unpaired data and Contrastive Alignment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T10:59:22.914974Z"},"links":{"cited_paper":"/paper/2301.11757","citing_paper":"/paper/2607.10537"},"observation_digest":"sha256:760a6b0fbcd8ddc4b49f3f0fc08c338949bcf4b09cebf3ca5bfb8a10b8ea53b7","observation_id":"9ba514c5-b7ad-4849-9845-3255d6c04415","resolution":{"observed_at":"2026-07-14T10:59:22.914974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11757","last_updated":"2023-10-23T20:47:30Z","snapshot_observed_at":"2026-07-06T14:45:19.481734Z","submitted_at":"2023-01-27T14:52:53Z","title":"Mo\\^usai: Text-to-Music Generation with Long-Context Latent Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11757","snapshot_observed_at":"2026-08-01T17:47:15.455231Z","title":"M ¨ousai: Text-to-music generation with long-context latent diffusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17526","last_updated":"2026-07-20T04:00:16Z","snapshot_observed_at":"2026-08-05T11:29:26.582848Z","submitted_at":"2026-07-20T04:00:16Z","title":"FlowSonic: Stable Zero-Shot Music Editing via High-Order Trajectory Integration","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T17:47:15.455231Z"},"links":{"cited_paper":"/paper/2301.11757","citing_paper":"/paper/2607.17526"},"observation_digest":"sha256:d0bff68e57bc74d40e508f16d67165d54bd18a5a25a05ff40b2185bd1cee2a6f","observation_id":"16103bf3-c5ab-4746-83a6-8cbac2672385","resolution":{"observed_at":"2026-08-01T17:47:15.455231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11757","last_updated":"2023-10-23T20:47:30Z","snapshot_observed_at":"2026-07-06T14:45:19.481734Z","submitted_at":"2023-01-27T14:52:53Z","title":"Mo\\^usai: Text-to-Music Generation with Long-Context Latent Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11757","snapshot_observed_at":"2026-08-08T17:54:23.085526Z","title":"Van Den Oord, A.; Vinyals, O.; et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05222","last_updated":"2026-08-05T11:03:33Z","snapshot_observed_at":"2026-08-09T23:10:19.537039Z","submitted_at":"2026-08-05T11:03:33Z","title":"Diff-Symbo: Text-Controlled Long-Duration Symbolic Music Generation Using Autoregressive Latent Diffusion Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T17:54:23.085526Z"},"links":{"cited_paper":"/paper/2301.11757","citing_paper":"/paper/2608.05222"},"observation_digest":"sha256:4fb2c6b337cd7215f51b287947a2299776d1de58e1e07020cf1b78f095431beb","observation_id":"81e39820-6994-451f-99b8-a8c7a942db3b","resolution":{"observed_at":"2026-08-08T17:54:23.085526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2301.11757/citation-record","integrity":"/paper/2301.11757/integrity","json":"/paper/2301.11757/citation-record.json","paper":"/paper/2301.11757"},"outbound":[],"paper":{"arxiv_id":"2301.11757","last_updated":"2023-10-23T20:47:30Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T14:45:19.481734Z","submitted_at":"2023-01-27T14:52:53Z","title":"Mo\\^usai: Text-to-Music Generation with Long-Context Latent Diffusion"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2301.11757."}