{"as_of":"2026-08-05T04:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:82aaaab19453a6ff32e1573bfed8ba15a92b7073857943a91163855213b2be75","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T07:05:04.187324Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T00:04:22.608820Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","snapshot_observed_at":"2026-08-02T16:58:30.102565Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":"2302.03917","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.03917","snapshot_observed_at":"2026-07-08T00:04:22.608820Z","title":"Noise2music: Text-conditioned music generation with diffusion models","venue":"cs.SD","work_id":"c46cc447-8a7d-4123-bbdf-96b5571efcb6","year":2023},"citing_paper":{"arxiv_id":"2305.02463","last_updated":"2023-05-03T23:59:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-03T23:59:13Z","title":"Shap-E: Generating Conditional 3D Implicit Functions","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T15:32:06.563955Z"},"links":{"cited_paper":"/paper/2302.03917","citing_paper":"/paper/2305.02463"},"observation_digest":"sha256:7e4a1e88924666a5c6b5447c4845a3f928f2dc9c7d18b4b7e3cbcf32850c4437","observation_id":"2aac7385-01d9-46ac-9a52-5ffe35473201","resolution":{"observed_at":"2026-05-16T15:32:06.770084Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","snapshot_observed_at":"2026-08-02T16:58:30.102565Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":"2302.03917","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.03917","snapshot_observed_at":"2026-07-08T00:04:22.608820Z","title":"Noise2music: Text-conditioned music generation with diffusion models","venue":"cs.SD","work_id":"c46cc447-8a7d-4123-bbdf-96b5571efcb6","year":2023},"citing_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-11T14:16:18.521699Z"},"links":{"cited_paper":"/paper/2302.03917","citing_paper":"/paper/2410.13720"},"observation_digest":"sha256:9937ff33dd426ac6cf68a91e964090b7993d14084559defa795e4a0342229821","observation_id":"eca944cf-56c8-4bf3-8dff-1ab0605dd869","resolution":{"observed_at":"2026-05-11T14:16:23.975684Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","snapshot_observed_at":"2026-08-02T16:58:30.102565Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":"2302.03917","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.03917","snapshot_observed_at":"2026-07-08T00:04:22.608820Z","title":"Noise2music: Text-conditioned music generation with diffusion models","venue":"cs.SD","work_id":"c46cc447-8a7d-4123-bbdf-96b5571efcb6","year":2023},"citing_paper":{"arxiv_id":"2411.15913","last_updated":"2026-05-13T09:39:21Z","snapshot_observed_at":"2026-07-06T19:56:12.654263Z","submitted_at":"2024-11-24T16:53:34Z","title":"Repurposing Image Diffusion Models for Training-Free Music Style Transfer on Mel-spectrograms","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-23T08:32:51.237590Z"},"links":{"cited_paper":"/paper/2302.03917","citing_paper":"/paper/2411.15913"},"observation_digest":"sha256:d1b475e2bf766201c8175d1cce0cf94a155a409393db1a776c10b24d0d388fb0","observation_id":"4d2759e9-e5bf-4ab9-9810-e44e547a7987","resolution":{"observed_at":"2026-05-23T08:35:29.732673Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","snapshot_observed_at":"2026-08-02T16:58:30.102565Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":"2302.03917","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.03917","snapshot_observed_at":"2026-07-08T00:04:22.608820Z","title":"Noise2music: Text-conditioned music generation with diffusion models","venue":"cs.SD","work_id":"c46cc447-8a7d-4123-bbdf-96b5571efcb6","year":2023},"citing_paper":{"arxiv_id":"2604.17986","last_updated":"2026-04-20T09:08:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-20T09:08:13Z","title":"Latent Fourier Transform","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T03:45:07.892234Z"},"links":{"cited_paper":"/paper/2302.03917","citing_paper":"/paper/2604.17986"},"observation_digest":"sha256:c9f20c514ca3c1c51642dcbbef7456dbef073d213225eacf29d154ac4228e87f","observation_id":"835621e8-4d12-4349-af34-4f93ca4f668a","resolution":{"observed_at":"2026-05-11T12:21:07.015691Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","snapshot_observed_at":"2026-08-02T16:58:30.102565Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":"2302.03917","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.03917","snapshot_observed_at":"2026-07-08T00:04:22.608820Z","title":"Noise2music: Text-conditioned music generation with diffusion models","venue":"cs.SD","work_id":"c46cc447-8a7d-4123-bbdf-96b5571efcb6","year":2023},"citing_paper":{"arxiv_id":"2605.17414","last_updated":"2026-05-17T12:22:17Z","snapshot_observed_at":"2026-08-02T05:33:24.963049Z","submitted_at":"2026-05-17T12:22:17Z","title":"S2Accompanist: A Semantic-Aware and Structure-Guided Diffusion Model for Music Accompaniment Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-19T22:50:08.321514Z"},"links":{"cited_paper":"/paper/2302.03917","citing_paper":"/paper/2605.17414"},"observation_digest":"sha256:65fae5152900bac9bf4e0c9a0a9840b143fdeb4d7dfe9a49801b90160400c24e","observation_id":"3b8d8a75-84f4-4d56-8c02-060757903951","resolution":{"observed_at":"2026-05-19T22:52:50.509604Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","snapshot_observed_at":"2026-08-02T16:58:30.102565Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":"2302.03917","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.03917","snapshot_observed_at":"2026-07-08T00:04:22.608820Z","title":"Noise2music: Text-conditioned music generation with diffusion models","venue":"cs.SD","work_id":"c46cc447-8a7d-4123-bbdf-96b5571efcb6","year":2023},"citing_paper":{"arxiv_id":"2606.01703","last_updated":"2026-06-01T05:12:20Z","snapshot_observed_at":"2026-07-06T23:42:12.125247Z","submitted_at":"2026-06-01T05:12:20Z","title":"JenBridge: Adaptive Long-Form Video Soundtracking across Scene Transitions","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T13:10:29.213917Z"},"links":{"cited_paper":"/paper/2302.03917","citing_paper":"/paper/2606.01703"},"observation_digest":"sha256:aa3e3b4f52466aca65df19d5fa66c959fbadbbcc2c1fc37cbe96ac1a70982e9e","observation_id":"6703c3df-9d62-4e89-bec4-759e24a71161","resolution":{"observed_at":"2026-07-02T00:56:24.705379Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","snapshot_observed_at":"2026-08-02T16:58:30.102565Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":"2302.03917","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.03917","snapshot_observed_at":"2026-07-08T00:04:22.608820Z","title":"Noise2music: Text-conditioned music generation with diffusion models","venue":"cs.SD","work_id":"c46cc447-8a7d-4123-bbdf-96b5571efcb6","year":2023},"citing_paper":{"arxiv_id":"2606.24307","last_updated":"2026-06-23T08:37:15Z","snapshot_observed_at":"2026-08-02T16:57:03.769831Z","submitted_at":"2026-06-23T08:37:15Z","title":"Real-Time Interactive Music Generation via Data-Free Streaming Consistency Distillation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-25T22:42:57.448084Z"},"links":{"cited_paper":"/paper/2302.03917","citing_paper":"/paper/2606.24307"},"observation_digest":"sha256:ce65f0f98292b837c6aab60399c82093dc32a7b44f6b88c371b83a26d2274192","observation_id":"ad8a4e55-1445-49d6-8647-b606405e5c84","resolution":{"observed_at":"2026-07-04T18:40:02.633895Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","snapshot_observed_at":"2026-08-02T16:58:30.102565Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":"2302.03917","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.03917","snapshot_observed_at":"2026-07-08T00:04:22.608820Z","title":"Noise2music: Text-conditioned music generation with diffusion models","venue":"cs.SD","work_id":"c46cc447-8a7d-4123-bbdf-96b5571efcb6","year":2023},"citing_paper":{"arxiv_id":"2607.05196","last_updated":"2026-07-07T15:36:48Z","snapshot_observed_at":"2026-07-11T07:46:45.098798Z","submitted_at":"2026-07-06T15:11:57Z","title":"Unified Audio Intelligence Without Regressing on Text Intelligence","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-07-07T23:59:38.702609Z"},"links":{"cited_paper":"/paper/2302.03917","citing_paper":"/paper/2607.05196"},"observation_digest":"sha256:0d60bb6942c2e43df9d2d77baff0cf18fc9c67242b8779c12c6ee848ee36cd51","observation_id":"9db21f8c-1fc6-4015-a917-b6380c2c3b29","resolution":{"observed_at":"2026-07-08T00:04:22.610666Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","snapshot_observed_at":"2026-08-02T16:58:30.102565Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03917","snapshot_observed_at":"2026-07-11T07:46:49.059192Z","title":"arXiv preprint arXiv:2302.03917 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05196","last_updated":"2026-07-07T15:36:48Z","snapshot_observed_at":"2026-07-11T07:46:45.098798Z","submitted_at":"2026-07-06T15:11:57Z","title":"Unified Audio Intelligence Without Regressing on Text Intelligence","version":2},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-07-11T07:46:49.059192Z"},"links":{"cited_paper":"/paper/2302.03917","citing_paper":"/paper/2607.05196"},"observation_digest":"sha256:b54ac264d1ddfed827d018d89286b06676901dd610e0e69a18d98f52f0489352","observation_id":"8418f976-53c8-4112-8b00-ae6de539a584","resolution":{"observed_at":"2026-07-11T07:46:49.059192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","snapshot_observed_at":"2026-08-02T16:58:30.102565Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03917","snapshot_observed_at":"2026-07-14T10:59:22.914974Z","title":"Noise2music: Text-conditioned music generation with diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10537","last_updated":"2026-07-12T02:40:27Z","snapshot_observed_at":"2026-07-16T23:18:50.103106Z","submitted_at":"2026-07-12T02:40:27Z","title":"Dance to Music Generation leveraging Pre-training with Unpaired data and Contrastive Alignment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T10:59:22.914974Z"},"links":{"cited_paper":"/paper/2302.03917","citing_paper":"/paper/2607.10537"},"observation_digest":"sha256:a2eb102ee9d432e64204c1bf368618d83f766a22cdfae4b7adf881b33244581d","observation_id":"98879aa0-8241-4e01-830b-39094736f6fd","resolution":{"observed_at":"2026-07-14T10:59:22.914974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","snapshot_observed_at":"2026-08-02T16:58:30.102565Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03917","snapshot_observed_at":"2026-07-14T06:45:43.330341Z","title":"Noise2music: Text-conditioned music generation with diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11143","last_updated":"2026-07-18T06:21:59Z","snapshot_observed_at":"2026-08-02T07:05:02.947075Z","submitted_at":"2026-07-13T06:26:28Z","title":"Anysynth:Zero-Shot Instrument Cloning via In-Context Learning and Asymmetric Hierarchical Guidance","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T06:45:43.330341Z"},"links":{"cited_paper":"/paper/2302.03917","citing_paper":"/paper/2607.11143"},"observation_digest":"sha256:ae6f07a4c4f3599c7d4643263867e6589add8a65fa5b26b2ff1cc722710d7d5b","observation_id":"3683c75c-7bf9-41af-b7d9-61610cab0cec","resolution":{"observed_at":"2026-07-14T06:45:43.330341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","snapshot_observed_at":"2026-08-02T16:58:30.102565Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03917","snapshot_observed_at":"2026-08-02T07:05:04.187324Z","title":"Noise2music: Text-conditioned music generation with diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11143","last_updated":"2026-07-18T06:21:59Z","snapshot_observed_at":"2026-08-02T07:05:02.947075Z","submitted_at":"2026-07-13T06:26:28Z","title":"Anysynth:Zero-Shot Instrument Cloning via In-Context Learning and Asymmetric Hierarchical Guidance","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T07:05:04.187324Z"},"links":{"cited_paper":"/paper/2302.03917","citing_paper":"/paper/2607.11143"},"observation_digest":"sha256:97ed58d5a9d1e3d303b3057a3228a50d2d0f63047008a30fb7aed8e141981357","observation_id":"2dc6e734-ab82-41b3-b91a-18b412ca60aa","resolution":{"observed_at":"2026-08-02T07:05:04.187324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","snapshot_observed_at":"2026-08-02T16:58:30.102565Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03917","snapshot_observed_at":"2026-07-14T03:47:22.936776Z","title":"Qingqing Huang, Daniel S Park, Tao Wang, Timo I Denk, Andy Ly, Nanxin Chen, Zhengdong Zhang, Zhishuai Zhang, Jiahui Yu, Christian Frank, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-04T20:17:05.144355Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T03:47:22.936776Z"},"links":{"cited_paper":"/paper/2302.03917","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:8aece421cbb7cb0aae3c7b11e8ebf9130d259e1d51745790539946da213ac18d","observation_id":"2b3a3ea5-6b82-430b-a2e1-714f927cb42b","resolution":{"observed_at":"2026-07-14T03:47:22.936776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","snapshot_observed_at":"2026-08-02T16:58:30.102565Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03917","snapshot_observed_at":"2026-08-02T06:52:27.502401Z","title":"Qingqing Huang, Daniel S Park, Tao Wang, Timo I Denk, Andy Ly, Nanxin Chen, Zhengdong Zhang, Zhishuai Zhang, Jiahui Yu, Christian Frank, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-04T20:17:05.144355Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:27.502401Z"},"links":{"cited_paper":"/paper/2302.03917","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:1653fb85b8e6e08de92dfd9ed57a8b870d736ecaa4667390c3e1a03f4e2e5aba","observation_id":"00a124f4-2a01-4bab-8e06-eb59a87321a6","resolution":{"observed_at":"2026-08-02T06:52:27.502401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","snapshot_observed_at":"2026-08-02T16:58:30.102565Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03917","snapshot_observed_at":"2026-08-01T17:47:12.237390Z","title":"Noise2music: Text-conditioned music generation with diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17526","last_updated":"2026-07-20T04:00:16Z","snapshot_observed_at":"2026-08-02T16:59:07.633326Z","submitted_at":"2026-07-20T04:00:16Z","title":"FlowSonic: Stable Zero-Shot Music Editing via High-Order Trajectory Integration","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T17:47:12.237390Z"},"links":{"cited_paper":"/paper/2302.03917","citing_paper":"/paper/2607.17526"},"observation_digest":"sha256:9c1f7606d05bb02236cf73cf5da9c8704c0d275c7e071598ceda827caacd5194","observation_id":"ede239d2-b610-4e20-a7c0-d065cdc4d680","resolution":{"observed_at":"2026-08-01T17:47:12.237390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","snapshot_observed_at":"2026-08-02T16:58:30.102565Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03917","snapshot_observed_at":"2026-07-31T23:25:26.807855Z","title":"arXiv preprint arXiv:2302.03917 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24873","last_updated":"2026-07-27T03:51:40Z","snapshot_observed_at":"2026-08-02T17:00:02.541643Z","submitted_at":"2026-07-27T03:51:40Z","title":"MusiChat: Vibe Composing for Music Creation","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-07-31T23:25:26.807855Z"},"links":{"cited_paper":"/paper/2302.03917","citing_paper":"/paper/2607.24873"},"observation_digest":"sha256:0a7b3c404d2f82242ceb815ee1791652c3cb89a4634a2a691f04fd59d235517d","observation_id":"ab0c43f7-3f42-4f3f-8ea9-1629982ca015","resolution":{"observed_at":"2026-07-31T23:25:26.807855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2302.03917/citation-record","integrity":"/paper/2302.03917/integrity","json":"/paper/2302.03917/citation-record.json","paper":"/paper/2302.03917"},"outbound":[],"paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-02T16:58:30.102565Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2302.03917."}