{"as_of":"2026-08-13T15:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6b440460464ea399849fecf611b9ed6a7bfd5ceb6cf8544fd859bef53644f251","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T12:52:03.979947Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T23:25:24.768275Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13786","snapshot_observed_at":"2026-07-31T23:25:24.768275Z","title":"arXiv preprint arXiv:2412.13786 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24873","last_updated":"2026-07-27T03:51:40Z","snapshot_observed_at":"2026-08-11T16:12:05.829417Z","submitted_at":"2026-07-27T03:51:40Z","title":"MusiChat: Vibe Composing for Music Creation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-07-31T23:25:24.768275Z"},"links":{"cited_paper":"/paper/2412.13786","citing_paper":"/paper/2607.24873"},"observation_digest":"sha256:497819edf585152786336a54d3a2bc8c11c22f10ef59d5020d93ef57084afebf","observation_id":"8e107320-052b-4339-9313-28f2ed88313c","resolution":{"observed_at":"2026-07-31T23:25:24.768275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.13786/citation-record","integrity":"/paper/2412.13786/integrity","json":"/paper/2412.13786/citation-record.json","paper":"/paper/2412.13786"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:03.655467Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.655467Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:d0c0b96039d51d2d56cc13a60f492288e199eefae79c15bed901db2591f0df73","observation_id":"aa11ddfc-c494-4493-9fc1-6604e78d1911","resolution":{"observed_at":"2026-08-11T12:52:03.655467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:03.661371Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.661371Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:b057914162df601cddeecf5a0fced1be2a17f5b4312876b8e8725eef4dacfeee","observation_id":"9a8bb378-5046-4cf0-a03b-d072382dd2b2","resolution":{"observed_at":"2026-08-11T12:52:03.661371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11325","last_updated":"2023-01-26T18:58:53Z","snapshot_observed_at":"2026-08-12T18:49:23.347422Z","submitted_at":"2023-01-26T18:58:53Z","title":"MusicLM: Generating Music From Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11325","snapshot_observed_at":"2026-08-11T12:52:03.667522Z","title":"I.; Borsos, Z.; Engel, J.; Verzetti, M.; Caillon, A.; Huang, Q.; Jansen, A.; Roberts, A.; Tagliasacchi, M.; et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.667522Z"},"links":{"cited_paper":"/paper/2301.11325","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:754960bf2b772a78fa42c1b5e74a4f53b5bb0a6523f3a2c3493166023b7cfbb6","observation_id":"eda56d33-e413-4772-aaa4-e5506b8429c5","resolution":{"observed_at":"2026-08-11T12:52:03.667522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:05.139698Z","title":null,"venue":null,"work_id":"4d850194-28ab-4af7-af36-65cb1e2b5f0e","year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.673026Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:9fd50bf499fba3075e1e6abefe47c83350158cf37d40c6fc7d2e44197b09bbe0","observation_id":"ba7695e6-2578-4501-b910-06488521443d","resolution":{"observed_at":"2026-08-11T12:52:05.145225Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:03.678198Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.678198Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:25c2d3753e9c956d548f7e0d2dcdc3128cc5294157aba110a635eab0e4028b46","observation_id":"96789809-496e-47ce-96b2-30cfd55eac4e","resolution":{"observed_at":"2026-08-11T12:52:03.678198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:05.111191Z","title":null,"venue":null,"work_id":"73aedf6f-b65b-4447-8ec6-27fd85b0a74a","year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.683501Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:3532e46ea2a7b56211e4e8cce1d4b2661507cd353ad862415e82ebafa2eef019","observation_id":"c1c6cb9d-ed4a-48b8-b141-916349310b06","resolution":{"observed_at":"2026-08-11T12:52:05.116343Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:05.092898Z","title":null,"venue":null,"work_id":"8a10d42c-173f-4d1a-9093-a37d4d863726","year":2024},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.688345Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:46130f7c26aaac2c5143f3212a6a5e581dd2c27d1cbd4a8bf3680e256016c666","observation_id":"deb5d453-2b08-4872-81d4-49211315978e","resolution":{"observed_at":"2026-08-11T12:52:05.098437Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06885","last_updated":"2025-05-20T15:53:10Z","snapshot_observed_at":"2026-08-01T23:52:25.071174Z","submitted_at":"2024-10-09T13:46:34Z","title":"F5-TTS: A Fairytaler that Fakes Fluent and Faithful Speech with Flow Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06885","snapshot_observed_at":"2026-08-11T12:52:03.693031Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.693031Z"},"links":{"cited_paper":"/paper/2410.06885","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:4868d28838da9c4d309abba3d202a5c2b64dbd30dc4b0acaa46cdfc1c6977fcb","observation_id":"c05759ee-2dff-4d09-9f9b-ce2b6ebe1e7c","resolution":{"observed_at":"2026-08-11T12:52:03.693031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:03.702166Z","title":"W.; Hou, L.; Longpre, S.; Zoph, B.; Tay, Y.; Fedus, W.; Li, Y.; Wang, X.; Dehghani, M.; Brahma, S.; et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.702166Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:37131b794342ee1030aa04ac09f99ebeb01fbc797d549050ef599ea91198d282","observation_id":"bfa86b90-5e7f-4c04-b031-b8a3175de4fc","resolution":{"observed_at":"2026-08-11T12:52:03.702166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:05.062128Z","title":null,"venue":null,"work_id":"4610e30a-af1f-462c-9bd1-7c4af0a5ccce","year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.707539Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:0287f87004c517ba7c161a2b32f73a09be37ec2b26a76390462e3c950059aed0","observation_id":"3a0f2153-75e7-4a8c-acb3-af0fac90f774","resolution":{"observed_at":"2026-08-11T12:52:05.066717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13438","last_updated":"2022-10-24T17:52:02Z","snapshot_observed_at":"2026-08-09T07:12:13.721596Z","submitted_at":"2022-10-24T17:52:02Z","title":"High Fidelity Neural Audio Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13438","snapshot_observed_at":"2026-08-11T12:52:03.712509Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.712509Z"},"links":{"cited_paper":"/paper/2210.13438","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:ff6c19e512e4629083626aa9088bc575425c6f2d3f7a68fe884944b299d20ada","observation_id":"7c81e6a6-332f-4e94-88db-ace4d6a84b39","resolution":{"observed_at":"2026-08-11T12:52:03.712509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-11T12:52:03.717900Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.717900Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:8b3529debf9623922a00558f6d835a277b7dbbfb73eb6e91296024c324c3c746","observation_id":"8372b830-9b83-4349-8779-0bfbcd17f9b2","resolution":{"observed_at":"2026-08-11T12:52:03.717900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00341","last_updated":"2020-04-30T09:02:45Z","snapshot_observed_at":"2026-08-06T03:57:57.420510Z","submitted_at":"2020-04-30T09:02:45Z","title":"Jukebox: A Generative Model for Music","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00341","snapshot_observed_at":"2026-08-11T12:52:03.723746Z","title":"W.; Radford, A.; and Sutskever, I","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.723746Z"},"links":{"cited_paper":"/paper/2005.00341","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:aaa1c451840ca9944be1e27bbafb51cdabf82df78ff52bdb408ea7b950cb6956","observation_id":"67d55bd4-ea09-4814-8243-170112e2d5fb","resolution":{"observed_at":"2026-08-11T12:52:03.723746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17645","last_updated":"2025-05-30T22:33:14Z","snapshot_observed_at":"2026-08-13T04:08:59.286926Z","submitted_at":"2024-02-27T16:15:28Z","title":"SongComposer: A Large Language Model for Lyric and Melody Generation in Song Composition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17645","snapshot_observed_at":"2026-08-11T12:52:03.730562Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.730562Z"},"links":{"cited_paper":"/paper/2402.17645","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:66bf36948b8384f3b4055c6d5a0bbfcf79ef56780642e36893cf7a50206eca80","observation_id":"900b900b-b8a9-4d01-b214-a8e1f592399b","resolution":{"observed_at":"2026-08-11T12:52:03.730562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12662","last_updated":"2023-01-30T04:53:23Z","snapshot_observed_at":"2026-08-13T12:55:29.316334Z","submitted_at":"2023-01-30T04:53:23Z","title":"SingSong: Generating musical accompaniments from singing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12662","snapshot_observed_at":"2026-08-11T12:52:03.736415Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.736415Z"},"links":{"cited_paper":"/paper/2301.12662","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:ed436dbbccd760eb1372d3bad3806618afbc122267cb827e9c8b92bfff5a586e","observation_id":"479057f4-693c-4482-afcb-b7afd7c06f49","resolution":{"observed_at":"2026-08-11T12:52:03.736415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:05.045667Z","title":null,"venue":null,"work_id":"b27c86eb-5013-4bec-b376-33495f1e48ad","year":2024},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.741835Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:5dc5708539aa5eb10f7f7fdbf9d577dafe5f7f162aa658ff6b07101becb651b4","observation_id":"0892b051-99e2-4cf2-a063-1ea11a94a10f","resolution":{"observed_at":"2026-08-11T12:52:05.051051Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14321","last_updated":"2025-03-14T00:10:58Z","snapshot_observed_at":"2026-08-13T04:34:37.827700Z","submitted_at":"2024-01-25T17:19:01Z","title":"VALL-T: Decoder-Only Generative Transducer for Robust and Decoding-Controllable Text-to-Speech","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14321","snapshot_observed_at":"2026-08-11T12:52:03.746686Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.746686Z"},"links":{"cited_paper":"/paper/2401.14321","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:159e9c12a8ec87bd5bf32eb945585756de7db220f72a53496415f8ed574a6cad","observation_id":"0ae819cd-248f-4fa9-b407-e7a11d952d32","resolution":{"observed_at":"2026-08-11T12:52:03.746686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:05.028009Z","title":null,"venue":null,"work_id":"bcb60470-4b12-471c-b590-c3ec815c3b42","year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.751843Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:e33d1cf913444e9513f7001edc97f3ba26c7fc7117e0a27bb81dcb3dbf6b56ef","observation_id":"3c8e9a88-1be7-4872-92c6-2c95718532d9","resolution":{"observed_at":"2026-08-11T12:52:05.033043Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10301","last_updated":"2024-07-29T14:52:26Z","snapshot_observed_at":"2026-08-13T00:55:04.612841Z","submitted_at":"2024-04-16T06:09:33Z","title":"Long-form music generation with latent diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10301","snapshot_observed_at":"2026-08-11T12:52:03.756797Z","title":"D.; Carr, C.; Zukowski, Z.; Taylor, J.; and Pons, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.756797Z"},"links":{"cited_paper":"/paper/2404.10301","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:b21e4114f82f54c03cb75bd7c084e23c7f17d723169195d74cdc509da7fe0855","observation_id":"cb3edcbf-530e-4901-98df-1f02fd63055c","resolution":{"observed_at":"2026-08-11T12:52:03.756797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04686","last_updated":"2023-07-12T17:06:41Z","snapshot_observed_at":"2026-08-13T10:58:54.722946Z","submitted_at":"2023-07-10T16:42:03Z","title":"VampNet: Music Generation via Masked Acoustic Token Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04686","snapshot_observed_at":"2026-08-11T12:52:03.761841Z","title":"F.; Seetharaman, P.; Kumar, R.; and Pardo, B","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.761841Z"},"links":{"cited_paper":"/paper/2307.04686","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:ab026b479c0549a3d00b59438c91c7b40cb2779921a86851065180477997dcb8","observation_id":"6cbe2a95-0608-4a2e-a561-090396b63775","resolution":{"observed_at":"2026-08-11T12:52:03.761841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:05.011216Z","title":null,"venue":null,"work_id":"e4e8c660-292f-4c37-afc0-9176eb3b8f96","year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.766677Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:252ea16ea735a14f8cb5e3d9f352591aade35af2724111fde6826c63ef7e2ddc","observation_id":"82bd7d95-0205-42fa-b1b6-d6bb2a76b885","resolution":{"observed_at":"2026-08-11T12:52:05.016424Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.993298Z","title":null,"venue":null,"work_id":"0c467b1e-3f16-4d64-bdb4-53fc99283660","year":2020},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.771367Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:75cf3fdad9a2447b725f47b9366f02de07335433aed1311189aa4c573463ece8","observation_id":"c3d40529-e748-44eb-9056-0163842c9a27","resolution":{"observed_at":"2026-08-11T12:52:04.999646Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-12T19:28:23.372660Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-11T12:52:03.776094Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.776094Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:219ab88aaa6b1386845f93d3cc33bf687b814369bcfd98704d95790157e089ed","observation_id":"37052916-4a63-4825-8588-cf920300ae09","resolution":{"observed_at":"2026-08-11T12:52:03.776094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:03.781330Z","title":"H.; Lakhotia, K.; Salakhutdinov, R.; and Mohamed, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.781330Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:f8ea03190ec444ced569f88fa2a87114c9b7736d3e4b288f0ec9ccd482a22055","observation_id":"5ec3f62d-696f-4d56-b855-d381a44f7b72","resolution":{"observed_at":"2026-08-11T12:52:03.781330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.962145Z","title":"Y.; and Ellis, D","venue":null,"work_id":"2cc17b74-1db3-4bad-b1c1-8080308f46d2","year":2022},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.786538Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:63b42131ac3990a9892ee6785a6c81c98f8100a5c72334d366d48fc8b6e190c3","observation_id":"a2a58336-c37c-4351-8db0-9f7b4e5d3c89","resolution":{"observed_at":"2026-08-11T12:52:04.967785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.943412Z","title":null,"venue":null,"work_id":"ca915bcd-1ce8-40d5-91cd-ead6176556de","year":2025},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.791364Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:7a10cee17d1ea231d508b04675a6b942d2c5534e01507aa7c16b1344fb34bc8c","observation_id":"6254b9ab-0eb0-4d59-8df2-54f8403c432e","resolution":{"observed_at":"2026-08-11T12:52:04.949042Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03509","last_updated":"2023-06-06T08:54:49Z","snapshot_observed_at":"2026-08-13T11:23:37.547715Z","submitted_at":"2023-06-06T08:54:49Z","title":"Mega-TTS: Zero-Shot Text-to-Speech at Scale with Intrinsic Inductive Bias","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03509","snapshot_observed_at":"2026-08-11T12:52:03.796299Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.796299Z"},"links":{"cited_paper":"/paper/2306.03509","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:a50cda0d7cb936568b24470ed46ce91ac88b81e2f40b35b0722a0a5462904405","observation_id":"fcd5234d-89a1-4dd1-a08e-24d446da1fa0","resolution":{"observed_at":"2026-08-11T12:52:03.796299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.922492Z","title":null,"venue":null,"work_id":"69a53fc1-5a2a-4aa4-8555-6fb6a01b7a9b","year":2019},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.801064Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:c064c7957707d2785091ca2061e99717e2cfc852e6a17115141ad66fdf048840","observation_id":"3f463a17-592b-4beb-b9e6-8dcf20803b9c","resolution":{"observed_at":"2026-08-11T12:52:04.927884Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.902786Z","title":null,"venue":null,"work_id":"68e86b88-7624-4906-9719-0ed0bbec34b6","year":2021},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.805913Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:b69e94a0e4b0ffb3caa850c0e892b3baf548cfd2b9258662b1948bb600e0122c","observation_id":"61a7b0d2-5735-48cd-8305-8c1bf530ee3d","resolution":{"observed_at":"2026-08-11T12:52:04.908234Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.885213Z","title":null,"venue":null,"work_id":"5dab6419-022b-4ac8-b152-b44c68eea297","year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.810514Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:1bdab0c43cb072da1f7a149a4edabeff0390866abf2fbc9f05bae158d0495b41","observation_id":"1b821b50-7427-496d-8ba7-02b28656aecb","resolution":{"observed_at":"2026-08-11T12:52:04.891284Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-11T12:52:03.815594Z","title":"P.; and Welling, M","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.815594Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:abe41e5b7f34fb048fda05ef50810c287b7452c3d8e06473280a2b53c20be696","observation_id":"f125e875-212b-48ae-bc95-ffb2684d4bb6","resolution":{"observed_at":"2026-08-11T12:52:03.815594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.865275Z","title":null,"venue":null,"work_id":"4d4233a3-4aa0-4edb-ab37-6dea0b376f90","year":2020},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.820518Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:50a7d77fc5fc8de420e2d0005c542f53ccbabf66c29fa48710957e86bef388e3","observation_id":"86824e4f-f998-4dc0-acd0-a336209c3efe","resolution":{"observed_at":"2026-08-11T12:52:04.870513Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.846283Z","title":null,"venue":null,"work_id":"7ea377be-abaa-408f-945d-0e1116f63693","year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.826588Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:69793dc075e53b64e8759fc4d3dbedd4836467443cfce7911371256c26b044bd","observation_id":"5f8c7fe3-3d91-40e1-a1af-08f5cb043487","resolution":{"observed_at":"2026-08-11T12:52:04.851675Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.829276Z","title":null,"venue":null,"work_id":"27020c43-bca7-4b68-951f-71c3cdad21a0","year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.831924Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:7d336ec695ca02296703d947d81b5644baeb06c613346df64f8ed2474528586b","observation_id":"dcfcc85e-0149-4988-910f-d468e6642cab","resolution":{"observed_at":"2026-08-11T12:52:04.834633Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.812679Z","title":null,"venue":null,"work_id":"22e9e33f-d6ee-42e1-9986-f2270bb58e9e","year":2024},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.837178Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:2c70a5a7c24b705276951866c88dadb4c49f186d349c7bef19462fea89808421","observation_id":"7559531f-73cd-4ba0-bfb5-d08969a24aa5","resolution":{"observed_at":"2026-08-11T12:52:04.817365Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17162","last_updated":"2024-10-06T21:36:20Z","snapshot_observed_at":"2026-08-13T05:40:08.895490Z","submitted_at":"2023-10-26T05:24:38Z","title":"Content-based Controls For Music Large Language Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17162","snapshot_observed_at":"2026-08-11T12:52:03.842740Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.842740Z"},"links":{"cited_paper":"/paper/2310.17162","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:5a8c1393fcae30200ef68fce7a8a6113a91d49ba25c28260163f661df115a479","observation_id":"61f12721-f41a-40da-b37f-110bfc3bc51b","resolution":{"observed_at":"2026-08-11T12:52:03.842740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.795148Z","title":null,"venue":null,"work_id":"9c158cfe-1d2b-4dc5-ba53-f274ac2bd00b","year":2022},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.848779Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:233fc71a6230b553d1029d8d1b0693086c032d9a887c167188374d2606c342c2","observation_id":"5fde5d86-4d19-4de3-8ff3-f95cb3f0df60","resolution":{"observed_at":"2026-08-11T12:52:04.800367Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-11T12:52:03.853848Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.853848Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:29caf6056431911447dabfeae537086ce1a6f700406a983a5566ba9667fcf08c","observation_id":"3cc687df-450f-4170-8c28-9dfd08743aa6","resolution":{"observed_at":"2026-08-11T12:52:03.853848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.779152Z","title":null,"venue":null,"work_id":"737978e2-e450-41f1-855f-cda61051aa0a","year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.860058Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:e622347a5011b1385f16df0c8f6e7a7f93eec2b86768c8b9144dca7efe7071fe","observation_id":"92d911de-2995-44c1-a9c3-41dd0d1a50b1","resolution":{"observed_at":"2026-08-11T12:52:04.783691Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.763407Z","title":null,"venue":null,"work_id":"7e2b42bc-48a1-4708-9ec7-aa3810d18a5a","year":2024},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.864730Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:65a4356a52123a60165c0922877ec5f529edfa059a8a83b766c23ea13d202811","observation_id":"573300aa-feac-4c8f-9201-cc41ed57f055","resolution":{"observed_at":"2026-08-11T12:52:04.768053Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.747184Z","title":null,"venue":null,"work_id":"2ad771dd-f6b3-45c3-aded-d991835536ef","year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.869873Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:c028408011331174b82599d06bc053b9b44a20f145420d1b303c1b6dda1ac1e5","observation_id":"eacd82c8-bbfe-4158-bc5b-bb0f3af54ad4","resolution":{"observed_at":"2026-08-11T12:52:04.752423Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.731585Z","title":null,"venue":null,"work_id":"bf948629-2302-4485-b03f-718159d31fad","year":2024},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.874796Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:b59b524d606db92f3010c3800b20b7dfc7be425d935d3f274137ceec9acfe109","observation_id":"b2c091c5-d0df-4637-9ad3-3e796a4411cb","resolution":{"observed_at":"2026-08-11T12:52:04.736418Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.713208Z","title":null,"venue":null,"work_id":"8ab54961-cf7c-41fd-b0c2-525a07ba7698","year":2020},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.879308Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:7848b0e4191ab18d81bad94d05c7c6a33e3f9fde6ad652a727bd7379861b5073","observation_id":"13679f74-3fd2-4f81-b643-6fc747ed50e9","resolution":{"observed_at":"2026-08-11T12:52:04.719014Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:03.884212Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.884212Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:8e56aa9b1c3bc92f0d19368a47160b80faca6e63232fcf33701d0809adef2486","observation_id":"e5f78b24-6506-42b4-bc72-ba87528f1ad3","resolution":{"observed_at":"2026-08-11T12:52:03.884212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:03.888623Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.888623Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:6aa88103ec84d91f61b90080d625ef6cffe2d5533f2520a73e6c9d264ebddb86","observation_id":"ff5157d2-7106-4477-8b8d-feb8a5458348","resolution":{"observed_at":"2026-08-11T12:52:03.888623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.673785Z","title":null,"venue":null,"work_id":"d189ab2a-d4b4-4d6e-9db7-100bc6143112","year":2015},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.893405Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:d1de8f3ea81d1a72cf765721daeff9f2657bce11bbcadf59f270a4e0cbc0ae13","observation_id":"9abc4a22-f302-47f9-aa0a-d5305401bfb7","resolution":{"observed_at":"2026-08-11T12:52:04.678927Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09116","last_updated":"2023-05-30T16:09:10Z","snapshot_observed_at":"2026-08-13T12:00:01.755113Z","submitted_at":"2023-04-18T16:31:59Z","title":"NaturalSpeech 2: Latent Diffusion Models are Natural and Zero-Shot Speech and Singing Synthesizers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09116","snapshot_observed_at":"2026-08-11T12:52:03.898392Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.898392Z"},"links":{"cited_paper":"/paper/2304.09116","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:2a700d18003b1329f6a0c6b7240974f461e36323bac7a5b009324ee430c89ab5","observation_id":"b3991449-f9d3-440e-b543-489e7dc9a9cb","resolution":{"observed_at":"2026-08-11T12:52:03.898392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:03.903930Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.903930Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:a612b90f25034f78b89a93351f5f851242247bb9ff26c918c1b7ed699da32822","observation_id":"749c8f48-b204-4208-8cc7-775ac90623b8","resolution":{"observed_at":"2026-08-11T12:52:03.903930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-11T12:52:03.909066Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.909066Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:2daaf421918a58110caf465fbbdd6567380d746f0f7a32804ec85b04e32f3e99","observation_id":"0941d1ae-5f12-409b-9787-ebab3596b53e","resolution":{"observed_at":"2026-08-11T12:52:03.909066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.645252Z","title":null,"venue":null,"work_id":"c863bddc-7b48-4580-85db-ff3ea0d9fce9","year":2017},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.915394Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:3fde7df7ca1aaa93222c13aea8838c60dc2c88631cc99ad03d3b4fa24d616f7c","observation_id":"be7631d8-ddf6-426a-abca-a618f1f38ac4","resolution":{"observed_at":"2026-08-11T12:52:04.650315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15821","last_updated":"2023-12-25T22:24:49Z","snapshot_observed_at":"2026-08-13T04:54:07.077274Z","submitted_at":"2023-12-25T22:24:49Z","title":"Audiobox: Unified Audio Generation with Natural Language Prompts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.15821","snapshot_observed_at":"2026-08-11T12:52:03.920679Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.920679Z"},"links":{"cited_paper":"/paper/2312.15821","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:2f32f2644354faadab74d0c4152f27c00b5681537b324f8dfd3dda74aa746dc8","observation_id":"ea093d5d-1bc7-4f91-b41f-9bbc2cd20518","resolution":{"observed_at":"2026-08-11T12:52:03.920679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.02111","last_updated":"2023-01-05T15:37:15Z","snapshot_observed_at":"2026-08-07T10:11:17.796562Z","submitted_at":"2023-01-05T15:37:15Z","title":"Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.02111","snapshot_observed_at":"2026-08-11T12:52:03.926006Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.926006Z"},"links":{"cited_paper":"/paper/2301.02111","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:217bf60b0ee5b8d4a9e4d27d050907d20888c943d92ae7ea3d52de2b3f26bec4","observation_id":"c10eb134-593b-43cb-a430-681cf129481b","resolution":{"observed_at":"2026-08-11T12:52:03.926006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.628357Z","title":null,"venue":null,"work_id":"7a21cb95-4df8-482d-83be-6827c16a60e1","year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.930813Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:99364b553735a8fb53a81300767ee6845a426e34d8000bdef861a0a78a150200","observation_id":"78349059-9fe2-4356-9a54-5fe4926889e5","resolution":{"observed_at":"2026-08-11T12:52:04.632987Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.610167Z","title":null,"venue":null,"work_id":"996fc903-ebc4-46c7-906a-d3d0f27d3e86","year":2024},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.935250Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:cdf873158709feea8f441861c9ca56beb09017eb0be32e08c71a01f52754e863","observation_id":"013c1724-a04f-4648-a9ae-0ffc14fafc83","resolution":{"observed_at":"2026-08-11T12:52:04.615758Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.591584Z","title":null,"venue":null,"work_id":"1a81b658-be34-4ea7-892a-d22cb43d8784","year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.939607Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:126d9341d50ab746bf333a56e4cfe267d64e8f96847fa4238d3694baa0e2f9d1","observation_id":"1139c40b-457d-4f31-92a2-d82acfed3fdb","resolution":{"observed_at":"2026-08-11T12:52:04.597406Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.574674Z","title":null,"venue":null,"work_id":"b83c9311-0817-4c91-9007-e4da104d64be","year":2024},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.944220Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:3661ff3c6385be0e99fb24b2d8c747571f05246116e8284881b7c6ea2ca555e0","observation_id":"09d5d2bc-4f97-4353-af53-54d8d7e4cf95","resolution":{"observed_at":"2026-08-11T12:52:04.579338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.554468Z","title":null,"venue":null,"work_id":"8af2c3f0-98dd-4196-877a-2da2cf3f026a","year":2024},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.949906Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:7f2e8b91b8f79961b1642ae6345f7519c1bfb70e837d790427ff1b1897807df7","observation_id":"47d0fdde-87da-4fba-987c-c47ee27d75b2","resolution":{"observed_at":"2026-08-11T12:52:04.563245Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.533511Z","title":null,"venue":null,"work_id":"7d876a72-b4d2-419f-9460-61b4f5d47cb5","year":2024},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.954461Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:76ef75a2488ba70f6c365d6d9cf2669a619a342bc34d5963799c98cfbe082aee","observation_id":"a24280de-aff9-4347-a0f1-1ccf80f63c2e","resolution":{"observed_at":"2026-08-11T12:52:04.539787Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.515432Z","title":null,"venue":null,"work_id":"7ee1b5cc-077e-4e16-bda9-cb943af3fd8f","year":2023},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.960128Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:5b1f799582382a6983fa22944953fca02e22a4cd52a66ebd70f25b683bbd7baf","observation_id":"540c59f4-f3e6-40c7-86f0-a0cbdba0645a","resolution":{"observed_at":"2026-08-11T12:52:04.520397Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:03.965249Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.965249Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:dd76d2e241e786d51a33e3f5e9d34df1c8b5cb0cdb6c6cea361f06c11aa7e4e7","observation_id":"84c6e5c4-ab3a-40af-bd1e-f2b2546011ea","resolution":{"observed_at":"2026-08-11T12:52:03.965249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.485311Z","title":null,"venue":null,"work_id":"381e57fd-6042-4260-ba27-b48817d344ba","year":2022},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.970590Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:623d2f74e5c79c87fd1538a137ee8e81d09770db5849132159dfbda9a6f9d9a7","observation_id":"d3af1a9c-4545-4a44-9601-6ea14db2fdd1","resolution":{"observed_at":"2026-08-11T12:52:04.491372Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:52:04.463097Z","title":"A.; Liao, W.-H.; Mitsufuji, Y.; and Dixon, S","venue":null,"work_id":"989d73f4-499f-4766-8d0d-bc1d59161f02","year":2024},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.975184Z"},"links":{"citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:88da5b63fd9f0dc3fe5d276892446ecb37532e35ece3e5b0ed7eb6e19f80a7a5","observation_id":"a22e9bc7-f59a-46be-9378-9d2c46bad50c","resolution":{"observed_at":"2026-08-11T12:52:04.470168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.02903","last_updated":"2022-11-05T13:35:00Z","snapshot_observed_at":"2026-08-13T13:48:55.410595Z","submitted_at":"2022-11-05T13:35:00Z","title":"VISinger 2: High-Fidelity End-to-End Singing Voice Synthesis Enhanced by Digital Signal Processing Synthesizer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.02903","snapshot_observed_at":"2026-08-11T12:52:03.979947Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T12:52:03.979947Z"},"links":{"cited_paper":"/paper/2211.02903","citing_paper":"/paper/2412.13786"},"observation_digest":"sha256:8e2e4b7e8466303b7099cf4aabd5a777a057d8d94c52a4f1cde0a953dff3e241","observation_id":"ce16652c-1fc9-4c80-acca-5e7177fe9db0","resolution":{"observed_at":"2026-08-11T12:52:03.979947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.13786","last_updated":"2025-01-28T17:29:51Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-13T12:14:54.753252Z","submitted_at":"2024-12-18T12:28:26Z","title":"SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":61,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 1 inbound Pith citation observation for arXiv:2412.13786."}