{"as_of":"2026-08-15T23:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:63aa3ea29296230af4a342ea561bd4c2c46ea85ad74c3ca479a22f21063c831b","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:30:20.530353Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.08787/citation-record","integrity":"/paper/2608.08787/integrity","json":"/paper/2608.08787/citation-record.json","paper":"/paper/2608.08787"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2301.11325","last_updated":"2023-01-26T18:58:53Z","snapshot_observed_at":"2026-08-14T02:16:19.922733Z","submitted_at":"2023-01-26T18:58:53Z","title":"MusicLM: Generating Music From Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11325","snapshot_observed_at":"2026-08-14T04:30:19.574279Z","title":"I.; Borsos, Z.; Engel, J.; Verzetti, M.; Caillon, A.; Huang, Q.; Jansen, A.; Roberts, A.; Tagliasacchi, M.; Sharifi, M.; Zeghidour, N.; and Frank, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.574279Z"},"links":{"cited_paper":"/paper/2301.11325","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:b3dec703b7fa7b8dda29563cbfaf31839aab7583e29febc7082c820f4007064c","observation_id":"72719cb3-7b5a-4d13-9351-f410d30d63c6","resolution":{"observed_at":"2026-08-14T04:30:19.574279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:23.202411Z","title":null,"venue":null,"work_id":"b5e31473-ad45-4de2-a00e-3c404ad14b01","year":2026},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.614916Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:009f9e81d7252efb3a7b00865b55ff06d28014be8c2f5f0cc4467a521b765f84","observation_id":"c29a899b-1f44-4769-b146-06d3cf96d377","resolution":{"observed_at":"2026-08-14T04:30:23.227048Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.09214","last_updated":"2024-09-19T07:14:20Z","snapshot_observed_at":"2026-08-14T15:28:50.907435Z","submitted_at":"2024-09-13T22:06:18Z","title":"Seed-Music: A Unified Framework for High Quality and Controlled Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.09214","snapshot_observed_at":"2026-08-14T04:30:19.647087Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.647087Z"},"links":{"cited_paper":"/paper/2409.09214","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:0b97676e09c9c909e31159452ffffe2c83ecd31a25dad961febc73f2d0bcd4b9","observation_id":"8de7c177-2a75-417a-b45a-35157f4ed05d","resolution":{"observed_at":"2026-08-14T04:30:19.647087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:23.135834Z","title":null,"venue":null,"work_id":"2512a243-9212-463f-a55d-bc7c221e24bf","year":2015},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.664607Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:4d8ad70de8429bd3ddc2ba1f2eaff679524cdc9033ea315633045685071b3686","observation_id":"cada0cb8-dd72-4b3f-85b0-4092a5b7248c","resolution":{"observed_at":"2026-08-14T04:30:23.169336Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:23.103910Z","title":null,"venue":null,"work_id":"9f2585fe-9006-4a22-9d78-eb5cb0d90a1e","year":2020},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.694755Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:9a8432ab134121edefc55c1b33c2d62625aa563ad40edfb58688021d07fe128e","observation_id":"40246809-0d54-443a-bcfd-105f8871948d","resolution":{"observed_at":"2026-08-14T04:30:23.109199Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:23.072646Z","title":null,"venue":null,"work_id":"da1fb2e7-f053-4217-80e5-d291da619ff1","year":2022},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.715659Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:3d582edcfc724719c8b4c4d910d6542d967a98bbfa4a83522d35e4747e3e37a8","observation_id":"c22d8264-2ab2-4170-af6a-160ed19aaee6","resolution":{"observed_at":"2026-08-14T04:30:23.077482Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:23.036514Z","title":null,"venue":null,"work_id":"b1ccd002-0bcc-40a3-9154-9f56a0a959bf","year":2023},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.750361Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:3b4dea47e52f6eece4201ae9dff2781d2d176e9adf1563b38b8ed0e5b9526ae4","observation_id":"b7bc3579-5362-47b1-80dc-55561a18db19","resolution":{"observed_at":"2026-08-14T04:30:23.041184Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:23.007656Z","title":null,"venue":null,"work_id":"25bd5c09-43dc-43a8-8267-3e532611547d","year":2023},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.785667Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:40b5f12b831562c8e5357eaac5fd68d2504dc0af572b869e85d9cb30665755ee","observation_id":"953a4758-771f-44e8-b5b7-e07533ebf2f3","resolution":{"observed_at":"2026-08-14T04:30:23.018554Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00341","last_updated":"2020-04-30T09:02:45Z","snapshot_observed_at":"2026-08-06T03:57:57.420510Z","submitted_at":"2020-04-30T09:02:45Z","title":"Jukebox: A Generative Model for Music","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00341","snapshot_observed_at":"2026-08-14T04:30:19.820828Z","title":"W.; Radford, A.; and Sutskever, I","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.820828Z"},"links":{"cited_paper":"/paper/2005.00341","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:81e09c666be552c6a619df45d2cad838e4b5e5f8df2ad3d81c7be235e4d6fc3e","observation_id":"8315f494-2c20-4e66-a443-ed0708557bab","resolution":{"observed_at":"2026-08-14T04:30:19.820828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.944751Z","title":"H.; and Pons, J","venue":null,"work_id":"809403fc-b3f1-42f0-8668-851cc21b96ac","year":2024},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.861524Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:ed40eca67c7438bb21cb8b5ed6fd218741d4bc7d9ef0607c86689c29bc79dca8","observation_id":"dcd38033-b11a-473f-b10d-8f1207faaf74","resolution":{"observed_at":"2026-08-14T04:30:22.974935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00045","last_updated":"2025-05-28T12:23:09Z","snapshot_observed_at":"2026-08-09T08:18:10.025134Z","submitted_at":"2025-05-28T12:23:09Z","title":"ACE-Step: A Step Towards Music Generation Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00045","snapshot_observed_at":"2026-08-14T04:30:19.892233Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.892233Z"},"links":{"cited_paper":"/paper/2506.00045","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:66df4447c6bf46e28da8708063c2aa59ae03363ce90f87b442eebed73fe02985","observation_id":"49941bad-a2f8-4920-83bd-d304cf9244a5","resolution":{"observed_at":"2026-08-14T04:30:19.892233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.861110Z","title":null,"venue":null,"work_id":"41a7c99c-4803-47b3-880f-f3b38e4ea19a","year":2026},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.925819Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:05c44f4d5fec50418e02c9a8a0520773fe9e1043484ab79b21b53b087d1fabd1","observation_id":"7f9b17d6-7afc-462e-92fc-6a023e9872f0","resolution":{"observed_at":"2026-08-14T04:30:22.873686Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.830508Z","title":null,"venue":null,"work_id":"14c7fdff-43b8-4c87-8e91-d3a6115d3d41","year":2020},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.968777Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:692dfd447b5222128c5dac7a3c576984b72c78fe498082b3b760222f3ba797eb","observation_id":"3f047a69-8add-4f93-9bc6-6c09c1e3495d","resolution":{"observed_at":"2026-08-14T04:30:22.838855Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.745084Z","title":"J.; Norouzi, M.; and Salimans, T","venue":null,"work_id":"7708dd49-ab25-4df3-b9bf-f618f42f69e2","year":2022},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:19.994743Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:fe56d841af61ab365f7ba2280db52c45120cd149d481ef4a74064a0c846a4b5a","observation_id":"420085f2-8d0a-47dc-b6cd-5c77640ce5e7","resolution":{"observed_at":"2026-08-14T04:30:22.751865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-14T04:30:20.025788Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.025788Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:60b1ebd71e606f2d45c51742ef67d7b375b3cbd6ad5caf2d0335697aa0ff3d65","observation_id":"83e867c4-411c-4a7c-a7c8-935f6e8facda","resolution":{"observed_at":"2026-08-14T04:30:20.025788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","snapshot_observed_at":"2026-08-14T07:31:45.753439Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03917","snapshot_observed_at":"2026-08-14T04:30:20.070783Z","title":"S.; Wang, T.; Denk, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.070783Z"},"links":{"cited_paper":"/paper/2302.03917","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:971277af84a1ea7f63f05f958444ce7306dc7ce1e1c122ad293ac5fa5fd5e82a","observation_id":"628d96e7-bdf5-45d1-89ed-20a6d4887ea2","resolution":{"observed_at":"2026-08-14T04:30:20.070783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.641174Z","title":null,"venue":null,"work_id":"d7f881fa-20be-447d-b14f-1b17226c5d59","year":2023},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.092328Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:f2399bd87b9faf07be8c02403573a694e52b97dcdb09e98cecd9d2dac10df831","observation_id":"a3c2249f-d2db-4ec1-ae06-4120e7259a53","resolution":{"observed_at":"2026-08-14T04:30:22.685338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.593641Z","title":null,"venue":null,"work_id":"72314dc6-05c2-4e7c-b3d3-1d9c4b0eb9d0","year":2025},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.128784Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:cae6ffbed29ee2469ed55eceef6fd11242e1accfe836d0de7dff02c2f53e15fc","observation_id":"4b4ba669-6872-4d0f-83fa-6fc496d15ab0","resolution":{"observed_at":"2026-08-14T04:30:22.616816Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:20.147363Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.147363Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:f5f935ebde5571214b466c23a49e74b494bd9e7c2474d3979171dc143bdca829","observation_id":"b2060076-179a-4426-8a8f-162ccdf8fe8e","resolution":{"observed_at":"2026-08-14T04:30:20.147363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22448","last_updated":"2024-10-29T18:29:39Z","snapshot_observed_at":"2026-08-12T22:12:26.422152Z","submitted_at":"2024-10-29T18:29:39Z","title":"A Closer Look at Neural Codec Resynthesis: Bridging the Gap between Codec and Waveform Generation","version":1},"cited_work":{"arxiv_id":"2410.22448","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.22448","snapshot_observed_at":"2026-08-14T04:30:21.255719Z","title":"A Closer Look at Neural Codec Resynthesis: Bridging the Gap between Codec and Waveform Generation","venue":"eess.AS","work_id":"7214d7ff-72cf-437f-abdd-bb02dbaae3e9","year":2024},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.164759Z"},"links":{"cited_paper":"/paper/2410.22448","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:f404302c1eceebfbd70b0b36e3b4e846241dd19620ea5709cdb9d65d080952da","observation_id":"cf73f3da-fb5d-484e-ac10-321e132ce791","resolution":{"observed_at":"2026-08-14T04:30:21.274751Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.00610","last_updated":"2026-06-11T15:20:43Z","snapshot_observed_at":"2026-08-14T18:43:03.691653Z","submitted_at":"2026-02-28T12:10:58Z","title":"CMI-RewardBench: Evaluating Music Reward Models with Compositional Multimodal Instruction","version":3},"cited_work":{"arxiv_id":"2603.00610","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.00610","snapshot_observed_at":"2026-08-14T04:30:21.141097Z","title":"CMI-RewardBench: Evaluating Music Reward Models with Compositional Multimodal Instruction","venue":"cs.SD","work_id":"02d78ad7-a169-4732-a35e-ec2a7c35664e","year":2026},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.194580Z"},"links":{"cited_paper":"/paper/2603.00610","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:d1135e1f0435c186c8b25ab51b903ed9b97a84805632284b8ab052801ef8d2b0","observation_id":"ea9c4619-b3ce-401c-ae47-6bcd1ef0fcf3","resolution":{"observed_at":"2026-08-14T04:30:21.180589Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.364283Z","title":null,"venue":null,"work_id":"1a3abb2b-27b0-4145-85e6-e6cd59e4a8ea","year":2026},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.215754Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:4b1f0ff83261f3b56a505e25e5c37d250a2bde9a2748ffbd8cb75626837af8c6","observation_id":"cb016b8b-3c4e-4764-9d56-c93ed6a7364b","resolution":{"observed_at":"2026-08-14T04:30:22.402089Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.309630Z","title":null,"venue":null,"work_id":"bcc183e2-c4ca-47c1-b0f1-5e4e89935adc","year":2026},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.232248Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:13d2496646f5b65ea637def610d6ee17fe00d00c0a9814af6bc6c55b66ed6a81","observation_id":"d382922d-0eeb-4a17-b2fd-344a5059d905","resolution":{"observed_at":"2026-08-14T04:30:22.327185Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01183","last_updated":"2025-03-03T05:15:34Z","snapshot_observed_at":"2026-08-13T12:51:33.315849Z","submitted_at":"2025-03-03T05:15:34Z","title":"DiffRhythm: Blazingly Fast and Embarrassingly Simple End-to-End Full-Length Song Generation with Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01183","snapshot_observed_at":"2026-08-14T04:30:20.247000Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.247000Z"},"links":{"cited_paper":"/paper/2503.01183","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:2a007de1cfa999ccadcae75ea3a1a111515986bb2d5302db05c7a0e99fd4b602","observation_id":"7a7d59d8-5d22-4d67-8047-e0b16b9f36a6","resolution":{"observed_at":"2026-08-14T04:30:20.247000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:20.255853Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.255853Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:7c1a99b276450ce1a69f9e9a3d87fe9d26c5c754b267152b7898ef242d882ad7","observation_id":"d6cb61c1-d4b5-48da-8c72-3891522b6c8b","resolution":{"observed_at":"2026-08-14T04:30:20.255853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.186558Z","title":null,"venue":null,"work_id":"2a4a38f2-e1a0-473e-b3f8-71a40b1c3ed0","year":2023},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.275969Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:1130462873243960fa071822ce1ce6645e7891a078278ac0a7368ddd35c69699","observation_id":"ebf03714-2758-4f93-9943-934d9fc11474","resolution":{"observed_at":"2026-08-14T04:30:22.207977Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.104791Z","title":null,"venue":null,"work_id":"d5abf1d9-759f-4f2d-905a-88b0c2ec5ce5","year":2026},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.291854Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:24b0553a0761016ca5ba0225ea969dafd54ef1441154d190d74016578126853b","observation_id":"8fadadd1-d0b2-426e-80bc-a711b5911273","resolution":{"observed_at":"2026-08-14T04:30:22.119689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:22.014822Z","title":null,"venue":null,"work_id":"31e86750-210c-4065-91b3-b6c5e864e8c3","year":2025},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.315645Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:fa8230c616077f2ae5ab1719673ccdefff6f8fe6cf5dc75084fe8ee90aa20c75","observation_id":"e08b0d14-0f6a-44dd-8a45-1983634ecad9","resolution":{"observed_at":"2026-08-14T04:30:22.036879Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05139","last_updated":"2025-02-07T18:15:57Z","snapshot_observed_at":"2026-08-14T10:00:02.244477Z","submitted_at":"2025-02-07T18:15:57Z","title":"Meta Audiobox Aesthetics: Unified Automatic Quality Assessment for Speech, Music, and Sound","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05139","snapshot_observed_at":"2026-08-14T04:30:20.333011Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.333011Z"},"links":{"cited_paper":"/paper/2502.05139","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:a40a33d2b4d1fcf18c1a5764b2846df20bacdded47f0d3127ad94dd0f83fa802","observation_id":"8290644d-78b3-4f87-a3c3-1885da5d5707","resolution":{"observed_at":"2026-08-14T04:30:20.333011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.25937","last_updated":"2026-04-16T04:26:34Z","snapshot_observed_at":"2026-08-15T16:06:56.859743Z","submitted_at":"2026-04-16T04:26:34Z","title":"SongBench: A Fine-Grained Multi-Aspect Benchmark for Song Quality Assessment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.25937","snapshot_observed_at":"2026-08-14T04:30:20.382198Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.382198Z"},"links":{"cited_paper":"/paper/2604.25937","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:70d85b47554b268e37d5adf8a75c6ce02398d09b1f6dce092742bb028dcb254e","observation_id":"cf0fc6c8-6e24-400d-9380-4d4bec1a61cf","resolution":{"observed_at":"2026-08-14T04:30:20.382198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:21.884747Z","title":null,"venue":null,"work_id":"a45857a0-f82b-4c33-b853-a56deb0d76f3","year":2020},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.424753Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:0ea016b0e781100f8b81ecd357a9e201a722c7e7937c1f2755a0c9d562a790e2","observation_id":"a7a8779a-e40a-44f7-b3ff-d1019fc4bf0f","resolution":{"observed_at":"2026-08-14T04:30:21.935045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:21.842867Z","title":null,"venue":null,"work_id":"35562ebe-6f55-4702-9b53-aaaaaabb4396","year":2025},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.444838Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:c5ae7d490812061b87518a8b4de925b90fec80e52515d0532f7876a9c04a0e73","observation_id":"96621dcc-2431-4e72-b876-9eb966a3e176","resolution":{"observed_at":"2026-08-14T04:30:21.857847Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.10547","last_updated":"2026-07-07T07:53:42Z","snapshot_observed_at":"2026-08-13T18:10:53.815074Z","submitted_at":"2026-01-15T16:14:25Z","title":"HeartMuLa: A Family of Open Sourced Music Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.10547","snapshot_observed_at":"2026-08-14T04:30:20.450381Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.450381Z"},"links":{"cited_paper":"/paper/2601.10547","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:690f2d9c0fb8c18bf1139b0ae699b2a279299ce27faa51030d0c711ca157eb34","observation_id":"dcecba95-cb9b-4b0e-8eeb-e79d4d940b12","resolution":{"observed_at":"2026-08-14T04:30:20.450381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10793","last_updated":"2025-05-16T02:06:25Z","snapshot_observed_at":"2026-08-15T21:01:03.472765Z","submitted_at":"2025-05-16T02:06:25Z","title":"SongEval: A Benchmark Dataset for Song Aesthetics Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10793","snapshot_observed_at":"2026-08-14T04:30:20.456408Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.456408Z"},"links":{"cited_paper":"/paper/2505.10793","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:7d9e633771cdf1663672a14a17eeaebd7a1ee97eb8c2cf535234e7727a7b377a","observation_id":"947395af-8dc5-467c-a540-516ec7b95e7e","resolution":{"observed_at":"2026-08-14T04:30:20.456408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:21.814171Z","title":null,"venue":null,"work_id":"bb9da171-8dda-4eb6-8c77-15855a5aee15","year":2022},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.474868Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:958ada63145c288f53c61e2dcc853f25787dbc4e071645cf85d35b93cd123a61","observation_id":"ec6f4166-ad33-41f6-9fc3-87593b41d02e","resolution":{"observed_at":"2026-08-14T04:30:21.831412Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00084","last_updated":"2025-02-28T09:58:25Z","snapshot_observed_at":"2026-08-14T15:25:57.923154Z","submitted_at":"2025-02-28T09:58:25Z","title":"InspireMusic: Integrating Super Resolution and Large Language Model for High-Fidelity Long-Form Music Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00084","snapshot_observed_at":"2026-08-14T04:30:20.485065Z","title":"H.; Zhou, K.; Jiang, Y.; Tan, C.; Gao, Z.; Du, Z.; and Ma, B","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.485065Z"},"links":{"cited_paper":"/paper/2503.00084","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:619a856fe65e8b4fe33963fdffc214bc904e4fa62faa05748b3ddc4afcfaba44","observation_id":"815d38a5-6e64-4cdd-acad-c99c8e7a4336","resolution":{"observed_at":"2026-08-14T04:30:20.485065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05176","last_updated":"2025-06-11T02:54:49Z","snapshot_observed_at":"2026-08-15T22:44:59.368534Z","submitted_at":"2025-06-05T15:49:48Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05176","snapshot_observed_at":"2026-08-14T04:30:20.504750Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.504750Z"},"links":{"cited_paper":"/paper/2506.05176","citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:7f021bb84e300569c76554b3c025fc51338be561c362dbfd4bce92c3ddc3e867","observation_id":"9b58c395-97f9-4887-b433-a49ed89094c6","resolution":{"observed_at":"2026-08-14T04:30:20.504750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:30:21.785272Z","title":null,"venue":null,"work_id":"84e790de-d657-4680-b0d7-9c1e89c7c345","year":2023},"citing_paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-14T04:30:20.530353Z"},"links":{"citing_paper":"/paper/2608.08787"},"observation_digest":"sha256:d0b5e2d45a1ba686171d82abf81d6c9fb0dc7ee9834b5890f425258453ec8a3b","observation_id":"a34fab11-d270-4ab1-ba48-8feee7ac38bf","resolution":{"observed_at":"2026-08-14T04:30:21.796452Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.08787","last_updated":"2026-08-11T03:16:14Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-15T19:01:17.045311Z","submitted_at":"2026-08-09T16:05:40Z","title":"Beyond Reconstruction: Full-Context Generative DiT for Music Generation"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":34,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2608.08787."}