{"as_of":"2026-08-18T18:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:19017822ecf995cfb81b3e4435af465893cf14b040b03cbde8e04c49e5e6ffb6","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":40,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:48:14.184505Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":65,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-12T18:03:55.400655Z","title":"Simple and controllable music generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12008","last_updated":"2024-12-11T20:34:25Z","snapshot_observed_at":"2026-08-18T02:00:29.600125Z","submitted_at":"2024-11-18T19:48:18Z","title":"Compression of Higher Order Ambisonics with Multichannel RVQGAN","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T18:03:55.400655Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2411.12008"},"observation_digest":"sha256:e5a318b92135e217ae66e7468e3ce538c908bc6e51f5a159c7690cd84da6ab2a","observation_id":"015bad08-9dfa-4516-b801-4b8eb21d3220","resolution":{"observed_at":"2026-08-12T18:03:55.400655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-12T11:14:10.098098Z","title":"Simple and Controllable Music Generation, June 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18447","last_updated":"2024-11-27T15:38:20Z","snapshot_observed_at":"2026-08-16T23:44:55.497575Z","submitted_at":"2024-11-27T15:38:20Z","title":"Continuous Autoregressive Models with Noise Augmentation Avoid Error Accumulation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T11:14:10.098098Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2411.18447"},"observation_digest":"sha256:a76ad9c2f6c570c25333f81a67e625584036825a2a5328807dc636f5a773e4a5","observation_id":"c73501f1-2b8a-416b-b589-aaffdb410fc8","resolution":{"observed_at":"2026-08-12T11:14:10.098098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-11T19:31:43.758323Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.06660","last_updated":"2024-12-09T16:59:35Z","snapshot_observed_at":"2026-08-13T09:14:45.905037Z","submitted_at":"2024-12-09T16:59:35Z","title":"MuMu-LLaMA: Multi-modal Music Understanding and Generation via Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T19:31:43.758323Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2412.06660"},"observation_digest":"sha256:7390ceaf08c7681b642b0275ac0abca42c43147df66ae2b2ec3b7deeca157e0b","observation_id":"c7093b46-d3e5-406a-a6fc-ec4ee3e93aed","resolution":{"observed_at":"2026-08-11T19:31:43.758323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-11T14:39:04.210717Z","title":"Preprint, arXiv:2306.05284","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11769","last_updated":"2024-12-16T13:44:19Z","snapshot_observed_at":"2026-08-15T19:55:12.182241Z","submitted_at":"2024-12-16T13:44:19Z","title":"Does it Chug? Towards a Data-Driven Understanding of Guitar Tone Description","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T14:39:04.210717Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2412.11769"},"observation_digest":"sha256:e6a5c5a2fff3acff3bb579f43a7310131ff17cf42a7771ce387f4dff97d8978e","observation_id":"a5ee50bf-ef37-495d-81c8-0968da81b5e8","resolution":{"observed_at":"2026-08-11T14:39:04.210717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-11T23:05:27.384167Z","title":"Simple and controllable music generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15220","last_updated":"2024-12-03T21:48:08Z","snapshot_observed_at":"2026-08-14T05:21:49.294095Z","submitted_at":"2024-12-03T21:48:08Z","title":"SyncFlow: Toward Temporally Aligned Joint Audio-Video Generation from Text","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T23:05:27.384167Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2412.15220"},"observation_digest":"sha256:6eba04d272d4385770d0393da575b10ca875361c10eabf3ca9e579c05a12032b","observation_id":"2defa89d-753a-45e7-a028-b0f7c1ae5177","resolution":{"observed_at":"2026-08-11T23:05:27.384167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-11T10:32:45.951571Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16526","last_updated":"2024-12-31T07:56:59Z","snapshot_observed_at":"2026-08-15T23:12:22.160819Z","submitted_at":"2024-12-21T08:09:12Z","title":"Text2midi: Generating Symbolic Music from Captions","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T10:32:45.951571Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2412.16526"},"observation_digest":"sha256:6333cdd4dc775f4e931483704f0a6e05ce370c8369decab18f96b829611a4ed0","observation_id":"7e94a373-7846-4e41-bd01-4691e474cd9d","resolution":{"observed_at":"2026-08-11T10:32:45.951571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-11T04:23:19.943911Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18940","last_updated":"2025-02-14T14:22:55Z","snapshot_observed_at":"2026-08-16T06:31:05.905998Z","submitted_at":"2024-12-25T16:23:32Z","title":"Amuse: Human-AI Collaborative Songwriting with Multimodal Inspirations","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T04:23:19.943911Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2412.18940"},"observation_digest":"sha256:5f73cb1fe858b1c7c7f1502ec7252cdaa14aaf083d07fe3e13be739366a0c9f6","observation_id":"9c1917b8-b625-4f79-a156-2ac8f280c0fe","resolution":{"observed_at":"2026-08-11T04:23:19.943911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-10T23:21:34.489417Z","title":"Simple and controllable music generation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.21037","last_updated":"2025-04-10T05:01:32Z","snapshot_observed_at":"2026-08-18T08:51:59.333838Z","submitted_at":"2024-12-30T16:02:44Z","title":"TangoFlux: Super Fast and Faithful Text to Audio Generation with Flow Matching and Clap-Ranked Preference Optimization","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:34.489417Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2412.21037"},"observation_digest":"sha256:f12e1135661420f94438032150f9a39568acbcfab1222846bf5caf96facd0dae","observation_id":"17d9e8d6-fb67-4da7-b3a6-bc6ace5d818f","resolution":{"observed_at":"2026-08-10T23:21:34.489417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-10T20:22:28.075307Z","title":"Simple and controllable music generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08809","last_updated":"2025-01-15T14:08:44Z","snapshot_observed_at":"2026-08-13T20:49:28.505135Z","submitted_at":"2025-01-15T14:08:44Z","title":"XMusic: Towards a Generalized and Controllable Symbolic Music Generation Framework","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T20:22:28.075307Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2501.08809"},"observation_digest":"sha256:e7d61eff4928dd6351f019d51c1baf787561c528ec0fb5f3ea65b2807898daa9","observation_id":"310d9072-1020-489a-b534-636b31027119","resolution":{"observed_at":"2026-08-10T20:22:28.075307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-16T10:48:14.184505Z","title":"Simple and Controllable Music Generation, June 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17308","last_updated":"2025-04-24T07:05:33Z","snapshot_observed_at":"2026-08-16T10:41:00.243481Z","submitted_at":"2025-04-24T07:05:33Z","title":"Physics-based super-resolved simulation of 3D elastic wave propagation adopting scalable Diffusion Transformer","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T10:48:14.184505Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2504.17308"},"observation_digest":"sha256:343b566f6ac813e8c1f50b9fd70e747beb338716149c7b88e01e80cb79fe2fa5","observation_id":"4494a254-b710-4842-96c8-eca2a94a774a","resolution":{"observed_at":"2026-08-16T10:48:14.184505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":"2306.05284","doi":"10.48550/arxiv.2306.05284","metadata_source":"pith","pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Strongly Recommend Advancing","venue":"cs.SD","work_id":"4b90222e-9c2e-41db-925e-e8dd0f3a18ee","year":2023},"citing_paper":{"arxiv_id":"2505.08203","last_updated":"2026-05-05T13:19:19Z","snapshot_observed_at":"2026-08-13T15:46:16.154746Z","submitted_at":"2025-05-13T03:33:36Z","title":"Not that Groove: Zero-Shot Symbolic Music Editing","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T16:27:44.903349Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2505.08203"},"observation_digest":"sha256:5adeb425d47da7f934e057528eef1dece55db586616240dc84f9b6c2ddbc7069","observation_id":"8f510aa7-92a7-4779-aeed-ef8919896fcd","resolution":{"observed_at":"2026-05-22T16:31:47.454536Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-15T20:34:08.656359Z","title":"Simple and controllable music generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12669","last_updated":"2025-05-19T03:36:06Z","snapshot_observed_at":"2026-08-18T18:06:03.697610Z","submitted_at":"2025-05-19T03:36:06Z","title":"Text2midi-InferAlign: Improving Symbolic Music Generation with Inference-Time Alignment","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:34:08.656359Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2505.12669"},"observation_digest":"sha256:d1a737d7f2f19df9f8049181f4264a157845a9b7da75af948469f8a664b51ece","observation_id":"80c0db12-d01d-4018-9579-6f9572d0fd4a","resolution":{"observed_at":"2026-08-15T20:34:08.656359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-07T15:12:00.911556Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15973","last_updated":"2025-05-21T19:44:58Z","snapshot_observed_at":"2026-08-17T15:47:08.992743Z","submitted_at":"2025-05-21T19:44:58Z","title":"An Exploratory Study on Multi-modal Generative AI in AR Storytelling","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:00.911556Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2505.15973"},"observation_digest":"sha256:533f6779b471c504915d27b85241508891c4658a92e2b14e8d20dce4b59a7450","observation_id":"4872cfcf-80f5-4e2c-93d7-2e36ea52d6aa","resolution":{"observed_at":"2026-08-07T15:12:00.911556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-07T14:19:57.022040Z","title":"Simple and controllable music generation.ArXiv, abs/2306.05284, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19462","last_updated":"2025-05-31T22:36:04Z","snapshot_observed_at":"2026-08-09T03:57:33.373890Z","submitted_at":"2025-05-26T03:35:44Z","title":"VoiceStar: Robust Zero-Shot Autoregressive TTS with Duration Control and Extrapolation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:19:57.022040Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2505.19462"},"observation_digest":"sha256:ddd59e84c9b1f30a46ac4c16b6ce6f25f59e634274db88a113ef6866be65f6e5","observation_id":"62d1ea48-ddeb-422a-afc6-9cd1cf666d36","resolution":{"observed_at":"2026-08-07T14:19:57.022040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-07T04:36:41.501328Z","title":"Simple and controllable music generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10225","last_updated":"2026-05-26T09:48:50Z","snapshot_observed_at":"2026-08-14T09:31:56.426872Z","submitted_at":"2025-06-11T23:02:39Z","title":"Genre Controlled Music Generation via Activation Steering","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:36:41.501328Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2506.10225"},"observation_digest":"sha256:e0a62b4f168eaabfbccd4e365305cc59838e99bbe6c79b8b3ccfb288533fb403","observation_id":"d0c96afd-3021-44d2-8d48-1776a4192859","resolution":{"observed_at":"2026-08-07T04:36:41.501328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-07T04:46:03.105405Z","title":"Simple and Controllable Music Generation , 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01022","last_updated":"2025-06-11T13:07:47Z","snapshot_observed_at":"2026-08-18T01:20:58.670786Z","submitted_at":"2025-06-11T13:07:47Z","title":"Workflow-Based Evaluation of Music Generation Systems","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T04:46:03.105405Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2507.01022"},"observation_digest":"sha256:755af6388dd2a061241acf3f700f8a298440ae9a1569a40dc439c2705e3d6475","observation_id":"48c7de91-5b00-4476-a80c-4e6e224a7fd3","resolution":{"observed_at":"2026-08-07T04:46:03.105405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-06T19:20:43.648942Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05894","last_updated":"2025-07-08T11:32:02Z","snapshot_observed_at":"2026-08-13T15:09:25.132345Z","submitted_at":"2025-07-08T11:32:02Z","title":"MusiScene: Leveraging MU-LLaMA for Scene Imagination and Enhanced Video Background Music Generation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T19:20:43.648942Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2507.05894"},"observation_digest":"sha256:e5f27570a9d789d896fa57fa82ec214b8017c1fcbaca26d9d36dc3ed19da0af2","observation_id":"ba603bf1-c396-4036-bf79-3f47981a2c36","resolution":{"observed_at":"2026-08-06T19:20:43.648942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-06T19:33:13.943392Z","title":"Simple and controllable music generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10447","last_updated":"2025-07-07T16:15:02Z","snapshot_observed_at":"2026-08-16T00:34:55.946843Z","submitted_at":"2025-07-07T16:15:02Z","title":"Evaluating Fake Music Detection Performance Under Audio Augmentations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:13.943392Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2507.10447"},"observation_digest":"sha256:cf7a939d177b7fee42b2c80dd93779546b3e4b24e98a01f57b0472e36b3e9e3e","observation_id":"b1b2ab89-abff-4b97-96d7-fcc952eb53aa","resolution":{"observed_at":"2026-08-06T19:33:13.943392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-06T15:52:20.371618Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15889","last_updated":"2025-07-20T02:10:46Z","snapshot_observed_at":"2026-08-12T10:30:14.521563Z","submitted_at":"2025-07-20T02:10:46Z","title":"Dr. Boot: Bootstrapping Program Synthesis Language Models to Perform Repairing","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T15:52:20.371618Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2507.15889"},"observation_digest":"sha256:767829d58ef554abf8524f28f91c9ab9b26a3d0f993ff01a18d277039cfe757b","observation_id":"9fd21212-cbf7-484a-a04a-ff8e4d488df3","resolution":{"observed_at":"2026-08-06T15:52:20.371618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":"2306.05284","doi":"10.48550/arxiv.2306.05284","metadata_source":"pith","pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Strongly Recommend Advancing","venue":"cs.SD","work_id":"4b90222e-9c2e-41db-925e-e8dd0f3a18ee","year":2023},"citing_paper":{"arxiv_id":"2507.16632","last_updated":"2025-08-27T16:42:11Z","snapshot_observed_at":"2026-08-13T23:38:52.637908Z","submitted_at":"2025-07-22T14:23:55Z","title":"Step-Audio 2 Technical Report","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T05:59:50.900436Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2507.16632"},"observation_digest":"sha256:6384ae4cb17c554a9bd9b2b49df383d5cdccd1f04124720211a7e7a5a6e87b8a","observation_id":"e8bdfe38-b2f6-4217-95aa-0588bd977870","resolution":{"observed_at":"2026-05-16T05:59:50.987583Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-06T13:14:37.487643Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-17T18:11:26.678020Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.487643Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:44cb5538bd02e54e039b151b18541bfd9bca5e84ec47c228427b6e0069f7baf4","observation_id":"0141dd42-155f-43c2-812c-96687559cbca","resolution":{"observed_at":"2026-08-06T13:14:37.487643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-05T13:24:09.362549Z","title":"Simple and controllable music generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00654","last_updated":"2025-08-31T01:27:16Z","snapshot_observed_at":"2026-08-13T15:19:44.435983Z","submitted_at":"2025-08-31T01:27:16Z","title":"The Name-Free Gap: Policy-Aware Stylistic Control in Music Generation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T13:24:09.362549Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2509.00654"},"observation_digest":"sha256:10c10ae280d264bea396672eeb500befde6720255de8104a890d1e76f2f6736e","observation_id":"40d9d6fe-381a-48c1-bf16-f5e5319c2db6","resolution":{"observed_at":"2026-08-05T13:24:09.362549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":"2306.05284","doi":"10.48550/arxiv.2306.05284","metadata_source":"pith","pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Strongly Recommend Advancing","venue":"cs.SD","work_id":"4b90222e-9c2e-41db-925e-e8dd0f3a18ee","year":2023},"citing_paper":{"arxiv_id":"2510.19127","last_updated":"2026-04-02T18:52:16Z","snapshot_observed_at":"2026-08-10T10:53:14.431760Z","submitted_at":"2025-10-21T23:23:14Z","title":"Steering Autoregressive Music Generation with Recursive Feature Machines","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T05:06:22.119543Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2510.19127"},"observation_digest":"sha256:48c9cfc909da283a2218cd7ef71ce412f81d279ae4f8b91ba65b71f88e9fe406","observation_id":"8e20d6f4-ad83-434f-a5b4-9414fa616036","resolution":{"observed_at":"2026-05-18T05:10:54.504104Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":"2306.05284","doi":"10.48550/arxiv.2306.05284","metadata_source":"pith","pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Strongly Recommend Advancing","venue":"cs.SD","work_id":"4b90222e-9c2e-41db-925e-e8dd0f3a18ee","year":2023},"citing_paper":{"arxiv_id":"2603.03190","last_updated":"2026-05-18T03:37:10Z","snapshot_observed_at":"2026-08-16T21:10:44.799529Z","submitted_at":"2026-03-03T17:47:09Z","title":"Expectation and Acoustic Neural Network Representations Enhance Music Identification from Brain Activity","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-21T11:36:06.967549Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2603.03190"},"observation_digest":"sha256:869fab369260b2f8b6d09f92a5a85fd4deb4977063c269429161ea40a97d222f","observation_id":"63d20b8a-d269-4e74-85e3-cfbc0c60b939","resolution":{"observed_at":"2026-05-21T11:40:03.136641Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":"2306.05284","doi":"10.48550/arxiv.2306.05284","metadata_source":"pith","pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Strongly Recommend Advancing","venue":"cs.SD","work_id":"4b90222e-9c2e-41db-925e-e8dd0f3a18ee","year":2023},"citing_paper":{"arxiv_id":"2604.01929","last_updated":"2026-04-29T10:54:09Z","snapshot_observed_at":"2026-07-06T22:51:40.181565Z","submitted_at":"2026-04-02T11:49:00Z","title":"Woosh: A Sound Effects Foundation Model","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T20:51:08.144573Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2604.01929"},"observation_digest":"sha256:5f48730bffea9d03591b934cfab68ca69919f80f459408f266fa00ba72ebbf97","observation_id":"6740619b-15bb-4885-8793-d98ef1513123","resolution":{"observed_at":"2026-05-13T20:53:15.796188Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":"2306.05284","doi":"10.48550/arxiv.2306.05284","metadata_source":"pith","pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Strongly Recommend Advancing","venue":"cs.SD","work_id":"4b90222e-9c2e-41db-925e-e8dd0f3a18ee","year":2023},"citing_paper":{"arxiv_id":"2605.14765","last_updated":"2026-05-14T12:31:46Z","snapshot_observed_at":"2026-08-12T22:29:23.181430Z","submitted_at":"2026-05-14T12:31:46Z","title":"Persian MusicGen: A Large-Scale Dataset and Culturally-Aware Generative Model for Persian Music","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-30T20:24:22.058025Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2605.14765"},"observation_digest":"sha256:154ba40a97f89527545ce7966ce4326b4ffec3945e480ceaf329366bd6ec0afa","observation_id":"12ce4162-219b-4bbe-9da3-5cd1b0eb5b7f","resolution":{"observed_at":"2026-06-30T20:25:02.381158Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":"2306.05284","doi":"10.48550/arxiv.2306.05284","metadata_source":"pith","pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Strongly Recommend Advancing","venue":"cs.SD","work_id":"4b90222e-9c2e-41db-925e-e8dd0f3a18ee","year":2023},"citing_paper":{"arxiv_id":"2605.20519","last_updated":"2026-05-21T17:49:53Z","snapshot_observed_at":"2026-08-17T16:09:33.805953Z","submitted_at":"2026-05-19T21:39:52Z","title":"Codec-Robust Attacks on Audio LLMs","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-21T06:43:52.735211Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2605.20519"},"observation_digest":"sha256:6d06136b61953a2b67a7ef0713b34bcce2d661b471a37611747dcfeb900b6082","observation_id":"8f41ebc9-a76d-4b16-9e98-4d0147665bb8","resolution":{"observed_at":"2026-05-21T06:44:00.705735Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":"2306.05284","doi":"10.48550/arxiv.2306.05284","metadata_source":"pith","pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Strongly Recommend Advancing","venue":"cs.SD","work_id":"4b90222e-9c2e-41db-925e-e8dd0f3a18ee","year":2023},"citing_paper":{"arxiv_id":"2605.20519","last_updated":"2026-05-21T17:49:53Z","snapshot_observed_at":"2026-08-17T16:09:33.805953Z","submitted_at":"2026-05-19T21:39:52Z","title":"Codec-Robust Attacks on Audio LLMs","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-25T05:44:46.831360Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2605.20519"},"observation_digest":"sha256:ec111f7105bca2c1c166144a66a27273e210963085912508262421604bd8afbf","observation_id":"e1756c19-589b-4194-9da7-1a6e6f1f1a78","resolution":{"observed_at":"2026-05-25T05:45:23.634674Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":"2306.05284","doi":"10.48550/arxiv.2306.05284","metadata_source":"pith","pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Strongly Recommend Advancing","venue":"cs.SD","work_id":"4b90222e-9c2e-41db-925e-e8dd0f3a18ee","year":2023},"citing_paper":{"arxiv_id":"2605.21081","last_updated":"2026-05-20T12:16:28Z","snapshot_observed_at":"2026-08-18T01:40:35.859397Z","submitted_at":"2026-05-20T12:16:28Z","title":"Musical Attention Transformer: Music Generation Using a Music-Specific Attention Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T01:44:20.282896Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2605.21081"},"observation_digest":"sha256:beb8c8d870d905dbdd10d68526dddd78b4239166f7114c99b43c92c4d8a47700","observation_id":"f4b178a2-23bc-4327-9337-c41382e1148d","resolution":{"observed_at":"2026-05-21T01:44:22.742201Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":"2306.05284","doi":"10.48550/arxiv.2306.05284","metadata_source":"pith","pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Strongly Recommend Advancing","venue":"cs.SD","work_id":"4b90222e-9c2e-41db-925e-e8dd0f3a18ee","year":2023},"citing_paper":{"arxiv_id":"2606.06928","last_updated":"2026-06-05T05:43:15Z","snapshot_observed_at":"2026-08-16T17:28:12.915614Z","submitted_at":"2026-06-05T05:43:15Z","title":"VoxCPM2 Technical Report","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T21:18:22.911332Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2606.06928"},"observation_digest":"sha256:5317203c59495e9b0915f298d11ee1434a302e63c899482ff886cd01f212d2ac","observation_id":"a4c900e1-4faa-4cff-a4f0-2731e2042c63","resolution":{"observed_at":"2026-07-02T19:47:19.760696Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":"2306.05284","doi":"10.48550/arxiv.2306.05284","metadata_source":"pith","pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Strongly Recommend Advancing","venue":"cs.SD","work_id":"4b90222e-9c2e-41db-925e-e8dd0f3a18ee","year":2023},"citing_paper":{"arxiv_id":"2606.11304","last_updated":"2026-06-09T18:00:04Z","snapshot_observed_at":"2026-08-15T02:16:59.333694Z","submitted_at":"2026-06-09T18:00:04Z","title":"SPADE: Split-and-Delay Embeddings for Autoregressive High-Granularity Calorimeter Simulation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-27T10:36:31.177334Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2606.11304"},"observation_digest":"sha256:1f2055711babdb99205d2fd1b7733b9109b6df3bbb415f31b43a05b24efff536","observation_id":"b1abda82-f88a-4f73-8ca9-c35c70d2d3d8","resolution":{"observed_at":"2026-07-03T08:57:48.014595Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":"2306.05284","doi":"10.48550/arxiv.2306.05284","metadata_source":"pith","pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Strongly Recommend Advancing","venue":"cs.SD","work_id":"4b90222e-9c2e-41db-925e-e8dd0f3a18ee","year":2023},"citing_paper":{"arxiv_id":"2607.00309","last_updated":"2026-07-01T01:21:42Z","snapshot_observed_at":"2026-08-15T14:02:10.823557Z","submitted_at":"2026-07-01T01:21:42Z","title":"A Text-Steerable Instrument for Sketching Procedural Soundscapes via Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-02T01:03:05.947082Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2607.00309"},"observation_digest":"sha256:5bc75d214e705f8693bae28a91ba57476e4f4aa66e75a3fd1628c2dbf73cd7fd","observation_id":"574c5526-2bee-4794-98d0-22a508eb905d","resolution":{"observed_at":"2026-07-02T01:06:23.624146Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":"2306.05284","doi":"10.48550/arxiv.2306.05284","metadata_source":"pith","pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Strongly Recommend Advancing","venue":"cs.SD","work_id":"4b90222e-9c2e-41db-925e-e8dd0f3a18ee","year":2023},"citing_paper":{"arxiv_id":"2607.06929","last_updated":"2026-07-08T02:49:29Z","snapshot_observed_at":"2026-08-14T20:43:49.691551Z","submitted_at":"2026-07-08T02:49:29Z","title":"MADB: A Large-Scale Music Aesthetics Dataset with Professional and Multi-Dimensional Annotations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-09T22:50:19.910504Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2607.06929"},"observation_digest":"sha256:75a32c11a73a5a45b79532937d2db72f5a83740163a653a6a6fb48d0138088fd","observation_id":"600d09f4-f8de-4494-9ec8-54884b5f3f2b","resolution":{"observed_at":"2026-07-09T22:56:37.707451Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-08T01:02:43.484701Z","title":"MusicGen: Simple and controllable music generation.arXiv preprint arXiv:2306.05284, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03040","last_updated":"2026-08-04T02:42:02Z","snapshot_observed_at":"2026-08-13T15:19:45.835438Z","submitted_at":"2026-08-04T02:42:02Z","title":"Calliphony: A Calligraphy-Driven Interface for Real-Time Generative Music Performance","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T01:02:43.484701Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2608.03040"},"observation_digest":"sha256:48a194c600c5f19fa36f25c24684e2e04881b7e9592155ec93bc93f58d6e877a","observation_id":"fa198a05-e9f1-4d08-962f-d5731700c5e1","resolution":{"observed_at":"2026-08-08T01:02:43.484701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-15T14:46:11.713429Z","title":"Simple and controllable music generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04142","last_updated":"2026-08-04T18:50:14Z","snapshot_observed_at":"2026-08-16T10:20:07.419953Z","submitted_at":"2026-08-04T18:50:14Z","title":"InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:11.713429Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2608.04142"},"observation_digest":"sha256:181e1f2679484d37baf128f02b6fd49ab94a10c2561fbc3fd79880ad6313b3e1","observation_id":"a30dda79-60c0-45ca-b789-f0d6c48f1f3a","resolution":{"observed_at":"2026-08-15T14:46:11.713429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-10T04:13:06.194405Z","title":"Simple and controllable music generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06634","last_updated":"2026-08-06T23:02:06Z","snapshot_observed_at":"2026-08-13T15:19:48.779522Z","submitted_at":"2026-08-06T23:02:06Z","title":"From Prompting to Describing: A Cross-Cultural Study of Language for AI-Generated Music","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T04:13:06.194405Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2608.06634"},"observation_digest":"sha256:2d21c663cf88e55f45d0d2f03fdc6457c78c1d8f78528f3872af21b3a0b78d32","observation_id":"de008ddd-fca0-4db4-8859-485427f3b02a","resolution":{"observed_at":"2026-08-10T04:13:06.194405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-10T04:15:02.117956Z","title":"Simple and controllable music generation.arXiv preprint arXiv:2306.05284, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06638","last_updated":"2026-08-06T23:09:37Z","snapshot_observed_at":"2026-08-17T23:58:43.393515Z","submitted_at":"2026-08-06T23:09:37Z","title":"MI-MIDI: Mechanistic Interpretability of Text-to-MIDI Generation Models via Probing, Lenses and Steering","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T04:15:02.117956Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2608.06638"},"observation_digest":"sha256:1638dd2154d24c030fd026aaf803be3906d3f2475ea9f0f3d9217af5fdc9ebb7","observation_id":"41b1e2cd-d159-4b4e-ae8e-10df592401fa","resolution":{"observed_at":"2026-08-10T04:15:02.117956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-14T04:32:47.852011Z","title":"Simple and Controllable Music Generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08667","last_updated":"2026-08-09T12:21:54Z","snapshot_observed_at":"2026-08-14T09:18:48.936467Z","submitted_at":"2026-08-09T12:21:54Z","title":"A Unifying Perspective on Audio Generative Modeling: Latent Representations and Modeling Strategies","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:47.852011Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2608.08667"},"observation_digest":"sha256:1c3f898a334b52963bd1a0541c2ca0ea2fe7c22b8b8f242401b915d71f371cb6","observation_id":"1452ac3a-e68b-402c-a1ba-a499c7043767","resolution":{"observed_at":"2026-08-14T04:32:47.852011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-15T14:23:37.325560Z","title":"ArXiv:2306.05284","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10360","last_updated":"2026-08-11T01:37:55Z","snapshot_observed_at":"2026-08-18T18:48:16.848774Z","submitted_at":"2026-08-11T01:37:55Z","title":"MazzikaAI: A knowledge-based performance-to-prompt compiler for real-time Arabic maqam accompaniment with a streaming text-to-music model","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T14:23:37.325560Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2608.10360"},"observation_digest":"sha256:df28957c7495d53d8079723df68efbff84b6f815cb49a13e531173eedad7c4a3","observation_id":"93531cab-400a-42ab-9244-967c08407814","resolution":{"observed_at":"2026-08-15T14:23:37.325560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-16T00:28:26.109837Z","title":"Simple and","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11899","last_updated":"2026-08-12T10:25:17Z","snapshot_observed_at":"2026-08-18T09:37:46.893485Z","submitted_at":"2026-08-12T10:25:17Z","title":"Do Text-to-Music Models Really Follow Instructions? A Counterfactual Evaluation of Key and Beat Grouping","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T00:28:26.109837Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2608.11899"},"observation_digest":"sha256:3fb35e89fea7d62939197af53a1e4a8401fef55c22133626d582708c79fda897","observation_id":"a0872711-aa1b-48fd-8ba2-2c101cb7a09e","resolution":{"observed_at":"2026-08-16T00:28:26.109837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2306.05284/citation-record","integrity":"/paper/2306.05284/integrity","json":"/paper/2306.05284/citation-record.json","paper":"/paper/2306.05284"},"outbound":[],"paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","latest_version":3,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-16T15:25:26.441326Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 40 inbound Pith citation observations for arXiv:2306.05284."}