{"as_of":"2026-08-07T04:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d568aabf7a5b460d4cc7c9697f3de9797bafbf548b75911eeafb1dbe91937694","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T13:14:37.611283Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T16:27:21.184654Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T08:53:16.247899Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"cited_work":{"arxiv_id":"2507.20880","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.20880","snapshot_observed_at":"2026-06-29T08:53:16.247899Z","title":"Jam: A tiny flow-based song generator with fine-grained controllability and aesthetic alignment,","venue":null,"work_id":"3c729e40-2fc7-4dda-81d9-486dd13fe5ca","year":2025},"citing_paper":{"arxiv_id":"2602.22029","last_updated":"2026-05-05T13:00:43Z","snapshot_observed_at":"2026-08-03T04:31:55.954534Z","submitted_at":"2026-02-24T06:43:27Z","title":"MIDI-Informed Singing Accompaniment Generation in a Compositional Song Pipeline","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T20:17:45.920234Z"},"links":{"cited_paper":"/paper/2507.20880","citing_paper":"/paper/2602.22029"},"observation_digest":"sha256:8797bb568b40ef14f5fa03974a3bc32bb64beff833e586e1374f25ea37cd1755","observation_id":"5d010dd4-bdf1-40f3-baee-ac8b6dfbb9bf","resolution":{"observed_at":"2026-05-15T20:20:18.010801Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"cited_work":{"arxiv_id":"2507.20880","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.20880","snapshot_observed_at":"2026-06-29T08:53:16.247899Z","title":"Jam: A tiny flow-based song generator with fine-grained controllability and aesthetic alignment,","venue":null,"work_id":"3c729e40-2fc7-4dda-81d9-486dd13fe5ca","year":2025},"citing_paper":{"arxiv_id":"2604.11052","last_updated":"2026-07-23T10:38:22Z","snapshot_observed_at":"2026-08-07T01:14:11.586651Z","submitted_at":"2026-04-13T06:29:34Z","title":"LaDA-Band: Language Diffusion Models for Vocal-to-Accompaniment Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T16:08:58.648967Z"},"links":{"cited_paper":"/paper/2507.20880","citing_paper":"/paper/2604.11052"},"observation_digest":"sha256:946c25f09c22a2439fc59253426905cd613c5b9b5345921472a8407ec5b3b7f7","observation_id":"a0c93e72-9db2-4ddd-8a13-8b8492357a89","resolution":{"observed_at":"2026-05-11T09:16:01.393207Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20880","snapshot_observed_at":"2026-08-02T16:27:21.184654Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.11052","last_updated":"2026-07-23T10:38:22Z","snapshot_observed_at":"2026-08-07T01:14:11.586651Z","submitted_at":"2026-04-13T06:29:34Z","title":"LaDA-Band: Language Diffusion Models for Vocal-to-Accompaniment Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T16:27:21.184654Z"},"links":{"cited_paper":"/paper/2507.20880","citing_paper":"/paper/2604.11052"},"observation_digest":"sha256:e0808742f03a2d4c7582ea57f8d437f22ad3f0ba946c561c6bbdc78f7644727a","observation_id":"5b2c3636-946d-46a5-935c-96f51a889316","resolution":{"observed_at":"2026-08-02T16:27:21.184654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"cited_work":{"arxiv_id":"2507.20880","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.20880","snapshot_observed_at":"2026-06-29T08:53:16.247899Z","title":"Jam: A tiny flow-based song generator with fine-grained controllability and aesthetic alignment,","venue":null,"work_id":"3c729e40-2fc7-4dda-81d9-486dd13fe5ca","year":2025},"citing_paper":{"arxiv_id":"2605.29202","last_updated":"2026-05-28T00:28:22Z","snapshot_observed_at":"2026-08-02T08:56:23.894748Z","submitted_at":"2026-05-28T00:28:22Z","title":"Auditing Training Data in Generative Music Models via Black-Box Membership Inference","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-29T08:45:23.523801Z"},"links":{"cited_paper":"/paper/2507.20880","citing_paper":"/paper/2605.29202"},"observation_digest":"sha256:8a0d0f6329e21ad2137ec69f0192195338430ade0fef0d050d8175db828c23cf","observation_id":"aea2f375-2f07-4724-bab3-1d5d30472535","resolution":{"observed_at":"2026-06-29T08:53:16.249689Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20880","snapshot_observed_at":"2026-07-14T06:56:53.384109Z","title":"Jam: A tiny flow-based song generator with fine-grained controllability and aesthetic alignment,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11117","last_updated":"2026-07-13T05:48:08Z","snapshot_observed_at":"2026-08-04T03:50:24.298863Z","submitted_at":"2026-07-13T05:48:08Z","title":"MusicMark: A Robust Generative Watermarking Framework for Music Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T06:56:53.384109Z"},"links":{"cited_paper":"/paper/2507.20880","citing_paper":"/paper/2607.11117"},"observation_digest":"sha256:06f304c21f6979529c63cf953e3f27711893285253e4ae5e54c7bceb71d8f349","observation_id":"80613037-6243-416d-a996-2c72cdc5f92d","resolution":{"observed_at":"2026-07-14T06:56:53.384109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20880","snapshot_observed_at":"2026-08-02T03:25:50.289899Z","title":"Jam: A tiny flow-based song generator with fine-grained controllability and aesthetic alignment,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13903","last_updated":"2026-07-15T14:44:50Z","snapshot_observed_at":"2026-08-06T02:24:49.601881Z","submitted_at":"2026-07-15T14:44:50Z","title":"Genre Bias or Aesthetic Perception? Identifying and Mitigating Shortcut Learning in Music Evaluation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T03:25:50.289899Z"},"links":{"cited_paper":"/paper/2507.20880","citing_paper":"/paper/2607.13903"},"observation_digest":"sha256:92c277311970ede753ca3f3c2b7c7345d096184a7c7c285ea86268ccddcf5aff","observation_id":"e521509e-55ca-4174-97c4-7dc62838335b","resolution":{"observed_at":"2026-08-02T03:25:50.289899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20880","snapshot_observed_at":"2026-07-30T23:40:07.807726Z","title":"Jam: A tiny flow-based song generator with fine- grained controllability and aesthetic alignment,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26698","last_updated":"2026-07-29T09:45:13Z","snapshot_observed_at":"2026-08-06T06:36:00.327490Z","submitted_at":"2026-07-29T09:45:13Z","title":"MPEcho: A Melody and Phoneme-Aware Generative Framework for Controllable Cover Song Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-30T23:40:07.807726Z"},"links":{"cited_paper":"/paper/2507.20880","citing_paper":"/paper/2607.26698"},"observation_digest":"sha256:2c7a8ac5a2c7c8d93d1aef25135568d3671687474046e67862684ab7bf103e3b","observation_id":"dac07c32-882d-4842-9577-0115ac9638d4","resolution":{"observed_at":"2026-07-30T23:40:07.807726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.20880/citation-record","integrity":"/paper/2507.20880/integrity","json":"/paper/2507.20880/citation-record.json","paper":"/paper/2507.20880"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:14:37.461446Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.461446Z"},"links":{"citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:b2fdcbcd2d6de435a17ffe6ccab4b1cfeab34a40f8acaf6637d335d545fdabc0","observation_id":"57fb4a25-eee4-48c0-a2f7-8a6d6933f632","resolution":{"observed_at":"2026-08-06T13:14:37.461446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:14:37.465194Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.465194Z"},"links":{"citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:331442ce4534f92b83e1301696497eec85dde0aa3b10ff9bd4cf20d954f5877f","observation_id":"789f67dc-8953-429a-9d80-5f3004b7a939","resolution":{"observed_at":"2026-08-06T13:14:37.465194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11325","last_updated":"2023-01-26T18:58:53Z","snapshot_observed_at":"2026-07-06T14:45:00.730733Z","submitted_at":"2023-01-26T18:58:53Z","title":"MusicLM: Generating Music From Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11325","snapshot_observed_at":"2026-08-06T13:14:37.469314Z","title":"I.; Borsos, Z.; Engel, J.; Verzetti, M.; Caillon, A.; Huang, Q.; Jansen, A.; Roberts, A.; Tagliasacchi, M.; Sharifi, M.; Zeghidour, N.; and Frank, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.469314Z"},"links":{"cited_paper":"/paper/2301.11325","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:843d3652a4ee369c46ec24d7bf95d31fdc12bacd41286c44c9362938a82464b7","observation_id":"b0d790fc-efd6-4ceb-b9d6-e384e5402e03","resolution":{"observed_at":"2026-08-06T13:14:37.469314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:14:38.192269Z","title":"R.; Schaefer, R","venue":null,"work_id":"9895f62b-5958-4459-a3b4-bbf5d4100b58","year":2021},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.472894Z"},"links":{"citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:5222eed5c3011752f5e1c68954bb0cf8bb964d43bf5a06832dc9474ff4a26257","observation_id":"a174ebd9-bd17-47f5-8542-a751e84c007e","resolution":{"observed_at":"2026-08-06T13:14:38.195513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12890","last_updated":"2025-07-24T08:15:02Z","snapshot_observed_at":"2026-08-06T16:33:09.899438Z","submitted_at":"2025-07-17T08:18:55Z","title":"DiffRhythm+: Controllable and Flexible Full-Length Song Generation with Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12890","snapshot_observed_at":"2026-08-06T13:14:37.476077Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.476077Z"},"links":{"cited_paper":"/paper/2507.12890","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:ba3e15a229671d0a60e987bc786bd2780b3f6f10e47cb0a893081cae2ea90774","observation_id":"efb8e615-99b2-46ca-8aca-80c2f07002e6","resolution":{"observed_at":"2026-08-06T13:14:37.476077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01546","last_updated":"2023-08-03T05:35:37Z","snapshot_observed_at":"2026-07-06T16:01:58.161047Z","submitted_at":"2023-08-03T05:35:37Z","title":"MusicLDM: Enhancing Novelty in Text-to-Music Generation Using Beat-Synchronous Mixup Strategies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01546","snapshot_observed_at":"2026-08-06T13:14:37.479613Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.479613Z"},"links":{"cited_paper":"/paper/2308.01546","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:367231231bdf4e3c3df873172e2b4f77f067b3392ce6d5198bb7dda0f7266918","observation_id":"41adfd8d-3ffc-4fe2-a485-e393538493a7","resolution":{"observed_at":"2026-08-06T13:14:37.479613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06885","last_updated":"2025-05-20T15:53:10Z","snapshot_observed_at":"2026-08-01T23:52:25.071174Z","submitted_at":"2024-10-09T13:46:34Z","title":"F5-TTS: A Fairytaler that Fakes Fluent and Faithful Speech with Flow Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06885","snapshot_observed_at":"2026-08-06T13:14:37.483935Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.483935Z"},"links":{"cited_paper":"/paper/2410.06885","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:59b1f978a6b12753fb44357a9086ee9e61e45371b0c59ddb714754788939db78","observation_id":"036d0f56-7b3f-46b9-83dd-701b3905c30f","resolution":{"observed_at":"2026-08-06T13:14:37.483935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05284","last_updated":"2024-01-30T04:49:16Z","snapshot_observed_at":"2026-08-05T13:52:05.523301Z","submitted_at":"2023-06-08T15:31:05Z","title":"Simple and Controllable Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05284","snapshot_observed_at":"2026-08-06T13:14:37.487643Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.487643Z"},"links":{"cited_paper":"/paper/2306.05284","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:fafeb02a4ce6bf05db0469e6f49c4c080e492e5036181556df8806d49de385b0","observation_id":"0141dd42-155f-43c2-812c-96687559cbca","resolution":{"observed_at":"2026-08-06T13:14:37.487643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:14:38.181663Z","title":null,"venue":null,"work_id":"647cfe4e-dc2e-4c65-8d55-917036dbf989","year":2021},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.491302Z"},"links":{"citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:5ffe10479bf322b26a277d0c54d72fffc54240352d37f1b1d6fc49acfe2d6dfc","observation_id":"75799a19-3eba-47e1-aa7e-57608731bd7e","resolution":{"observed_at":"2026-08-06T13:14:38.184723Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03206","last_updated":"2024-03-05T18:45:39Z","snapshot_observed_at":"2026-07-06T17:40:01.975792Z","submitted_at":"2024-03-05T18:45:39Z","title":"Scaling Rectified Flow Transformers for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03206","snapshot_observed_at":"2026-08-06T13:14:37.494139Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.494139Z"},"links":{"cited_paper":"/paper/2403.03206","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:48502287f5e76cf229673ef662baabbcc132ca7d9d53f9ab52ade0bec1323db1","observation_id":"b3c23ef1-dd48-40e2-8734-6175c6c43e7d","resolution":{"observed_at":"2026-08-06T13:14:37.494139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-06T13:14:37.497860Z","title":"D.; Carr, C.; Zukowski, Z.; Taylor, J.; and Pons, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.497860Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:e8606c33296031d27dde7779dd1ad3df47ea527e62190832be98a847c9bd8d84","observation_id":"20588f1c-a788-4721-8f1a-a3798bf2e111","resolution":{"observed_at":"2026-08-06T13:14:37.497860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:14:38.170275Z","title":null,"venue":null,"work_id":"32e2c411-b990-4c0d-8018-a190a1020188","year":1998},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.501362Z"},"links":{"citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:0d32e49ec40cf809e0de973ac4c3d34e9ff0f59e476c3c3ec743151062a23a96","observation_id":"7987e618-abb5-429e-9b60-38dd15d06900","resolution":{"observed_at":"2026-08-06T13:14:38.174426Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13731","last_updated":"2023-05-29T12:09:08Z","snapshot_observed_at":"2026-07-06T15:20:25.388057Z","submitted_at":"2023-04-24T07:45:28Z","title":"Text-to-Audio Generation using Instruction-Tuned LLM and Latent Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13731","snapshot_observed_at":"2026-08-06T13:14:37.504432Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.504432Z"},"links":{"cited_paper":"/paper/2304.13731","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:dff1e57e111559386ce2811b6453b68c403b27cfe6bc20b969df2138464e21d0","observation_id":"90dc13ef-de70-403c-83d4-b6dcc99ece2f","resolution":{"observed_at":"2026-08-06T13:14:37.504432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00045","last_updated":"2025-05-28T12:23:09Z","snapshot_observed_at":"2026-07-06T21:33:55.658995Z","submitted_at":"2025-05-28T12:23:09Z","title":"ACE-Step: A Step Towards Music Generation Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00045","snapshot_observed_at":"2026-08-06T13:14:37.507871Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.507871Z"},"links":{"cited_paper":"/paper/2506.00045","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:66d912142ebc2c88afb048db691ba53170a7ae6a6caad17c2aef7aee3643f81a","observation_id":"607794e3-305a-4413-8fa2-5d90040a27f4","resolution":{"observed_at":"2026-08-06T13:14:37.507871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11239","last_updated":"2020-12-16T21:15:05Z","snapshot_observed_at":"2026-07-06T09:30:47.469703Z","submitted_at":"2020-06-19T17:24:44Z","title":"Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11239","snapshot_observed_at":"2026-08-06T13:14:37.511182Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.511182Z"},"links":{"cited_paper":"/paper/2006.11239","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:9bdf55f7e12d13e5bdfd718ac092d2cb5e18fe6d667d6074363c7450f9363847","observation_id":"3f76b9df-9fd3-440e-ae6c-5217ab0c77a6","resolution":{"observed_at":"2026-08-06T13:14:37.511182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09313","last_updated":"2024-05-20T05:50:36Z","snapshot_observed_at":"2026-08-05T08:46:18.238095Z","submitted_at":"2024-04-14T18:00:05Z","title":"Text-to-Song: Towards Controllable Music Generation Incorporating Vocals and Accompaniment","version":3},"cited_work":{"arxiv_id":"2404.09313","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09313","snapshot_observed_at":"2026-08-06T13:14:38.023477Z","title":"Text-to-Song: Towards Controllable Music Generation Incorporating Vocals and Accompaniment","venue":"eess.AS","work_id":"eb4e83e6-a69b-4e15-ac8e-92772380b09a","year":2024},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.514538Z"},"links":{"cited_paper":"/paper/2404.09313","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:23ee6ae61fafb3e48cb4799ca44ebc7bc700df487481abe890f061015689ea52","observation_id":"d68b5b89-3299-43ec-b5b4-2ce023b466c7","resolution":{"observed_at":"2026-08-06T13:14:38.027610Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21037","last_updated":"2025-04-10T05:01:32Z","snapshot_observed_at":"2026-08-03T09:49:19.218280Z","submitted_at":"2024-12-30T16:02:44Z","title":"TangoFlux: Super Fast and Faithful Text to Audio Generation with Flow Matching and Clap-Ranked Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21037","snapshot_observed_at":"2026-08-06T13:14:37.521235Z","title":"A.; Li, C.; Valle, R.; Catanzaro, B.; and Poria, S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.521235Z"},"links":{"cited_paper":"/paper/2412.21037","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:4483764ee681d53c70d0d7cb58c09d59ce46ce5aefe2eaa18aa7634d5a0d06a7","observation_id":"89187b51-2060-42e8-8272-45b469a396f2","resolution":{"observed_at":"2026-08-06T13:14:37.521235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18924","last_updated":"2025-03-28T05:34:33Z","snapshot_observed_at":"2026-08-06T20:26:07.096518Z","submitted_at":"2025-02-26T08:22:00Z","title":"MegaTTS 3: Sparse Alignment Enhanced Latent Diffusion Transformer for Zero-Shot Speech Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18924","snapshot_observed_at":"2026-08-06T13:14:37.524679Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.524679Z"},"links":{"cited_paper":"/paper/2502.18924","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:35ddcd9df5f9f75dea25e3afc866d2888c881ee0c989265a667405d95eec98ad","observation_id":"693a491d-ead1-4089-a240-50699ac46ec3","resolution":{"observed_at":"2026-08-06T13:14:37.524679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16425","last_updated":"2023-07-31T06:20:01Z","snapshot_observed_at":"2026-08-06T14:19:23.717852Z","submitted_at":"2023-07-31T06:20:01Z","title":"All-In-One Metrical And Functional Structure Analysis With Neighborhood Attentions on Demixed Audio","version":1},"cited_work":{"arxiv_id":"2307.16425","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.16425","snapshot_observed_at":"2026-08-06T13:14:37.986352Z","title":"All-In-One Metrical And Functional Structure Analysis With Neighborhood Attentions on Demixed Audio","venue":"eess.AS","work_id":"d54c747f-f65f-4463-80dc-4cbb8fcc2609","year":2023},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.528040Z"},"links":{"cited_paper":"/paper/2307.16425","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:e64b8796d4510fdb295f0f30d229309580930c2e395d3323a78fc9d737643a27","observation_id":"48a06430-896c-4813-b6ca-53e8219f3fe1","resolution":{"observed_at":"2026-08-06T13:14:37.990533Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15719","last_updated":"2023-05-25T05:02:35Z","snapshot_observed_at":"2026-08-02T03:48:01.262470Z","submitted_at":"2023-05-25T05:02:35Z","title":"Efficient Neural Music Generation","version":1},"cited_work":{"arxiv_id":"2305.15719","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.15719","snapshot_observed_at":"2026-08-06T13:14:37.970073Z","title":"Efficient Neural Music Generation","venue":"cs.SD","work_id":"8dd8edc5-3d5e-486e-b574-286b0512e8ba","year":2023},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.531625Z"},"links":{"cited_paper":"/paper/2305.15719","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:71297ade3d83af88f1268c6efeb3ac4864365832f23df940b4aa16777b8be657","observation_id":"b132b310-1c76-4d35-a390-3e747420eff6","resolution":{"observed_at":"2026-08-06T13:14:37.974170Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:14:37.535090Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.535090Z"},"links":{"citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:a2f906ca82d49946ef7c9dc37f2778418e0ae55f98f59610f5f6cb92a7c34857","observation_id":"35d82b2b-550e-4e53-9a73-bbbb8ef2c7e6","resolution":{"observed_at":"2026-08-06T13:14:37.535090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06029","last_updated":"2024-10-30T20:44:46Z","snapshot_observed_at":"2026-07-06T19:12:49.406398Z","submitted_at":"2024-09-09T19:37:07Z","title":"SongCreator: Lyrics-based Universal Song Generation","version":2},"cited_work":{"arxiv_id":"2409.06029","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.06029","snapshot_observed_at":"2026-08-06T13:14:37.878408Z","title":"SongCreator: Lyrics-based Universal Song Generation","venue":"cs.SD","work_id":"6303126d-004e-49f0-8bfe-dd6abd8fa08f","year":2024},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.538408Z"},"links":{"cited_paper":"/paper/2409.06029","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:c936c2d034360ed04ffcd676ca91a6c0362f8aee0af50ab01cb99f5975cb4827","observation_id":"616b0abb-5cd3-4aa8-a8e1-fa40398c58a3","resolution":{"observed_at":"2026-08-06T13:14:37.884868Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-06T13:14:37.541913Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.541913Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:7f76b6eadf10674143fad34aa699161174fb92d4325cca5fc3070fdf07dad945","observation_id":"6116d424-258b-4fb3-8051-8d69cd93cdfd","resolution":{"observed_at":"2026-08-06T13:14:37.541913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05734","last_updated":"2024-05-11T11:24:51Z","snapshot_observed_at":"2026-07-06T16:04:58.235073Z","submitted_at":"2023-08-10T17:55:13Z","title":"AudioLDM 2: Learning Holistic Audio Generation with Self-supervised Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05734","snapshot_observed_at":"2026-08-06T13:14:37.545619Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.545619Z"},"links":{"cited_paper":"/paper/2308.05734","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:b118769de851ab84adfd6efb772869dab38853a92b6c52b2f639d3843fdeffb2","observation_id":"8bb57f59-89c8-42be-b281-b63b528f5c1d","resolution":{"observed_at":"2026-08-06T13:14:37.545619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13128","last_updated":"2025-05-30T06:59:18Z","snapshot_observed_at":"2026-08-05T05:30:50.545455Z","submitted_at":"2025-02-18T18:52:21Z","title":"SongGen: A Single Stage Auto-regressive Transformer for Text-to-Song Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13128","snapshot_observed_at":"2026-08-06T13:14:37.549941Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.549941Z"},"links":{"cited_paper":"/paper/2502.13128","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:94dbc6da25fd6dd2ff2b3b7e7ab90d60b78bba8390eda0a186a9f475bff2ed3a","observation_id":"a8b70e32-35a6-457c-a76f-276f7874771f","resolution":{"observed_at":"2026-08-06T13:14:37.549941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09956","last_updated":"2024-07-17T16:17:50Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:31:22Z","title":"Tango 2: Aligning Diffusion-based Text-to-Audio Generations through Direct Preference Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09956","snapshot_observed_at":"2026-08-06T13:14:37.557921Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.557921Z"},"links":{"cited_paper":"/paper/2404.09956","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:cfcb75597ee5e3eeff9ecbf22de30eac722c0f12c5a4fac8773ce82569901438","observation_id":"0e9d28d4-4408-4b6d-9bbd-29e4bd1a5891","resolution":{"observed_at":"2026-08-06T13:14:37.557921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08355","last_updated":"2024-06-03T07:56:23Z","snapshot_observed_at":"2026-08-06T19:39:54.540216Z","submitted_at":"2023-11-14T17:54:38Z","title":"Mustango: Toward Controllable Text-to-Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08355","snapshot_observed_at":"2026-08-06T13:14:37.561225Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.561225Z"},"links":{"cited_paper":"/paper/2311.08355","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:276d98187f106a05d6af1e26c2c7265108c404393e0f4a69466f428002db6b42","observation_id":"4d39e694-9084-43a8-bad0-ca9069f4858c","resolution":{"observed_at":"2026-08-06T13:14:37.561225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01183","last_updated":"2025-03-03T05:15:34Z","snapshot_observed_at":"2026-08-04T20:09:44.803153Z","submitted_at":"2025-03-03T05:15:34Z","title":"DiffRhythm: Blazingly Fast and Embarrassingly Simple End-to-End Full-Length Song Generation with Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01183","snapshot_observed_at":"2026-08-06T13:14:37.565855Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.565855Z"},"links":{"cited_paper":"/paper/2503.01183","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:270d252e7a155119219c51037bff8dd3b68ea257fc92b5181efb85e234b5ce54","observation_id":"a576708f-3079-4de0-bb3b-aea9e883f4f6","resolution":{"observed_at":"2026-08-06T13:14:37.565855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:14:38.159302Z","title":null,"venue":null,"work_id":"22e42110-61d5-4c57-978f-eee5da565a07","year":2025},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.570042Z"},"links":{"citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:66c621cb933f548f2f794b06107ce7365ea6db8975a8e62e5d1f4f2570ff7296","observation_id":"3251a5ae-931c-45ca-b755-824b4b6d31c4","resolution":{"observed_at":"2026-08-06T13:14:38.163059Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09748","last_updated":"2023-03-02T09:06:55Z","snapshot_observed_at":"2026-07-06T14:32:37.317828Z","submitted_at":"2022-12-19T18:59:58Z","title":"Scalable Diffusion Models with Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09748","snapshot_observed_at":"2026-08-06T13:14:37.573931Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.573931Z"},"links":{"cited_paper":"/paper/2212.09748","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:ca8b0970313841e4fb49d53f9196f435584c6fc848d87a94ba27271acf1e3b00","observation_id":"2467df98-faef-4280-94b6-387de7614228","resolution":{"observed_at":"2026-08-06T13:14:37.573931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-06T13:14:37.577933Z","title":"D.; and Finn, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.577933Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:7d5ef58d726db9ef9d175f792730a4c676d955874308c5e86b54a6737abbed0d","observation_id":"af481409-a8c0-47b8-9d66-cfd5eaa97491","resolution":{"observed_at":"2026-08-06T13:14:37.577933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:14:38.147765Z","title":null,"venue":null,"work_id":"d9bf8915-2f8f-4a0e-b747-2ca85d118cde","year":2023},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.581567Z"},"links":{"citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:685a5a5667bdc3da1dd82b59cf6e5a4c1baea59a87a8e380d87fc7538d98ff55","observation_id":"c1f7f180-2b06-4cc9-921f-92093c3217a9","resolution":{"observed_at":"2026-08-06T13:14:38.151163Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-06T13:14:37.585448Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.585448Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:130d6f2ce4273c8304b3edd00c11d45254f9c5e1e92e451242b3bba3e41abc81","observation_id":"fb04a0eb-3121-45c4-98c1-140212cfe8e1","resolution":{"observed_at":"2026-08-06T13:14:37.585448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:14:38.136138Z","title":null,"venue":null,"work_id":"8b628ac5-e602-40d8-b070-b1372be78bc5","year":2025},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.589341Z"},"links":{"citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:35f52edb35536590a63de187ff80823b1068745ef842f32747fb7c82f7200da7","observation_id":"0e63d302-5a32-456e-b912-3e9c05ca74aa","resolution":{"observed_at":"2026-08-06T13:14:38.139522Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.00937","last_updated":"2018-05-30T14:58:27Z","snapshot_observed_at":"2026-08-01T14:58:21.912263Z","submitted_at":"2017-11-02T21:14:44Z","title":"Neural Discrete Representation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.00937","snapshot_observed_at":"2026-08-06T13:14:37.592863Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.592863Z"},"links":{"cited_paper":"/paper/1711.00937","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:7ba459c537aadfd0307c0554833098294d5525fc6d0210e725e8c75d7b85e561","observation_id":"d41eb002-785b-4509-aca7-a463c170f86d","resolution":{"observed_at":"2026-08-06T13:14:37.592863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12908","last_updated":"2023-11-21T15:24:05Z","snapshot_observed_at":"2026-07-06T16:50:46.608196Z","submitted_at":"2023-11-21T15:24:05Z","title":"Diffusion Model Alignment Using Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12908","snapshot_observed_at":"2026-08-06T13:14:37.596571Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.596571Z"},"links":{"cited_paper":"/paper/2311.12908","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:1470eb5396a176e8563ef49a15388f57d429e54ca65a76a0b2c17f839dbac003","observation_id":"fb51a5c4-3969-482f-8a79-c0e61b108993","resolution":{"observed_at":"2026-08-06T13:14:37.596571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.15808","last_updated":"2021-03-29T17:58:22Z","snapshot_observed_at":"2026-08-07T00:58:44.603491Z","submitted_at":"2021-03-29T17:58:22Z","title":"CvT: Introducing Convolutions to Vision Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.15808","snapshot_observed_at":"2026-08-06T13:14:37.600229Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.600229Z"},"links":{"cited_paper":"/paper/2103.15808","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:775ec62020627b3f3ad47523afbf2b443b95b82afa38e0e38ef2048260573eac","observation_id":"348189fe-11a6-49c0-bba1-d12b81a82286","resolution":{"observed_at":"2026-08-06T13:14:37.600229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10793","last_updated":"2025-05-16T02:06:25Z","snapshot_observed_at":"2026-08-06T08:13:52.709687Z","submitted_at":"2025-05-16T02:06:25Z","title":"SongEval: A Benchmark Dataset for Song Aesthetics Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10793","snapshot_observed_at":"2026-08-06T13:14:37.604021Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.604021Z"},"links":{"cited_paper":"/paper/2505.10793","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:9ad9a01a9c2536700ad140c7c643d2672519df6acc24da642150a8abce967dfd","observation_id":"e99e7926-8ba2-4216-9e30-27833fd466f5","resolution":{"observed_at":"2026-08-06T13:14:37.604021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:14:37.607639Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.607639Z"},"links":{"citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:5363cd2c95fd6e0999436e427e99aee2461c1f95c898cee3183e888e1e384f96","observation_id":"10545351-45af-424e-80c5-2f48634f3e0d","resolution":{"observed_at":"2026-08-06T13:14:37.607639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01108","last_updated":"2025-01-03T08:35:34Z","snapshot_observed_at":"2026-08-02T14:58:36.177043Z","submitted_at":"2025-01-02T07:08:29Z","title":"MuQ: Self-Supervised Music Representation Learning with Mel Residual Vector Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01108","snapshot_observed_at":"2026-08-06T13:14:37.611283Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.611283Z"},"links":{"cited_paper":"/paper/2501.01108","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:24a070ac14a91a1a6ca9c21fc92634f00ade5a449151a967c0f8c99c6c221b2e","observation_id":"1779be4a-a5ee-4b63-9754-a35d71feaeb3","resolution":{"observed_at":"2026-08-06T13:14:37.611283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":4,"verified_fuzzy":1},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 7 inbound Pith citation observations for arXiv:2507.20880."}