{"as_of":"2026-08-21T01:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b25197b48722d08bf675f8e9ce7aa87d526526750cbefbb9e5e025ed49384260","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T06:52:28.950800Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:47:17.856444Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T14:47:18.031102Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"cited_work":{"arxiv_id":"2607.11699","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.11699","snapshot_observed_at":"2026-08-15T14:47:18.031102Z","title":"Qwen-Music Technical Report","venue":"cs.SD","work_id":"97cca3bf-9313-4d45-a7c6-059e6bad2fc9","year":2026},"citing_paper":{"arxiv_id":"2608.03999","last_updated":"2026-08-04T17:56:49Z","snapshot_observed_at":"2026-08-18T20:50:14.421543Z","submitted_at":"2026-08-04T17:56:49Z","title":"Agogic: Performance-Timed Music Tokens for LLM-Native Text-to-Symbolic-Music Generation","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-08-15T14:47:17.856444Z"},"links":{"cited_paper":"/paper/2607.11699","citing_paper":"/paper/2608.03999"},"observation_digest":"sha256:360e9b7db04fe06a111bbda90c64ac35b1e539003f5be54648f8676d13421d69","observation_id":"ffedfe6f-134d-4e7d-a5c3-9bb761be2cf2","resolution":{"observed_at":"2026-08-15T14:47:18.035570Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2607.11699/citation-record","integrity":"/paper/2607.11699/integrity","json":"/paper/2607.11699/citation-record.json","paper":"/paper/2607.11699"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2301.11325","last_updated":"2023-01-26T18:58:53Z","snapshot_observed_at":"2026-08-20T13:40:28.954978Z","submitted_at":"2023-01-26T18:58:53Z","title":"MusicLM: Generating Music From Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11325","snapshot_observed_at":"2026-08-02T06:52:26.259761Z","title":"Musiclm: Generating music from text","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:26.259761Z"},"links":{"cited_paper":"/paper/2301.11325","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:cc5ec082c2977111d4de94383280bfeb9c835b24fdc9eda68ac19529660a303f","observation_id":"22162cda-4730-4ee8-bf5b-380b2f3ae010","resolution":{"observed_at":"2026-08-02T06:52:26.259761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-16T13:32:41.679971Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-02T06:52:26.744184Z","title":"Parker, CJ Carr, Zack Zukowski, Josiah Taylor, and Jordi Pons","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:26.744184Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:d893a72670a5fe41896bd8a2cda1829df539e71ea76d3bc4eea10b796fe5f329","observation_id":"3b51116b-5e17-4cf2-80b0-95f815b455b6","resolution":{"observed_at":"2026-08-02T06:52:26.744184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00045","last_updated":"2025-05-28T12:23:09Z","snapshot_observed_at":"2026-08-09T08:18:10.025134Z","submitted_at":"2025-05-28T12:23:09Z","title":"ACE-Step: A Step Towards Music Generation Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00045","snapshot_observed_at":"2026-08-02T06:52:26.903347Z","title":"Ace-step: A step towards music generation foundation model.arXiv preprint arXiv:2506.00045,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:26.903347Z"},"links":{"cited_paper":"/paper/2506.00045","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:ce59781f258c1c744f1575c74e4ce3b1e7cefc07292366413ad21315841af75c","observation_id":"fe00cef8-e6c0-4493-ab55-6566a33784d9","resolution":{"observed_at":"2026-08-02T06:52:26.903347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.30642","last_updated":"2026-06-29T17:59:20Z","snapshot_observed_at":"2026-08-13T14:26:47.969747Z","submitted_at":"2026-06-29T17:59:20Z","title":"LeVo 2: Stable and Melodious Song Generation via Hierarchical Representation Modeling and Progressive Post-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.30642","snapshot_observed_at":"2026-08-02T06:52:27.618202Z","title":"Levo: High-quality song generation with multi-preference alignment.Advances in Neural Information Processing Systems, 38:102448–102479, 2026a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:27.618202Z"},"links":{"cited_paper":"/paper/2606.30642","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:913aef4e464ea645ddc9b4493e346c655fd09ca98d302dbae263517acef27969","observation_id":"1d5ceed8-6d78-4a00-a75d-5acb568d44cc","resolution":{"observed_at":"2026-08-02T06:52:27.618202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13128","last_updated":"2025-05-30T06:59:18Z","snapshot_observed_at":"2026-08-20T09:39:43.655664Z","submitted_at":"2025-02-18T18:52:21Z","title":"SongGen: A Single Stage Auto-regressive Transformer for Text-to-Song Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13128","snapshot_observed_at":"2026-08-02T06:52:27.980157Z","title":"Songgen: A single stage auto-regressive transformer for text-to-song generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:27.980157Z"},"links":{"cited_paper":"/paper/2502.13128","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:5b56ffd60c9c60ec0c0f9281a642b9ca2d3b1de29bc1bf564ee73c7a4f8dd37c","observation_id":"4f9fd48c-289f-4274-adba-a1967616bf4f","resolution":{"observed_at":"2026-08-02T06:52:27.980157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03917","last_updated":"2023-03-06T18:09:56Z","snapshot_observed_at":"2026-08-17T19:40:07.322177Z","submitted_at":"2023-02-08T07:27:27Z","title":"Noise2Music: Text-conditioned Music Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03917","snapshot_observed_at":"2026-08-02T06:52:27.502401Z","title":"Qingqing Huang, Daniel S Park, Tao Wang, Timo I Denk, Andy Ly, Nanxin Chen, Zhengdong Zhang, Zhishuai Zhang, Jiahui Yu, Christian Frank, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:27.502401Z"},"links":{"cited_paper":"/paper/2302.03917","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:105c2cc98f6a3f784c39c3019f190b50282c1bdd78b02df0a8a4f4eb20aa484c","observation_id":"00a124f4-2a01-4bab-8e06-eb59a87321a6","resolution":{"observed_at":"2026-08-02T06:52:27.502401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:52:28.101670Z","title":"The song describer dataset: a corpus of audio captions for music-and-language evaluation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:28.101670Z"},"links":{"citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:cb41690c3a87358cede734f2272311dbf2c3a5916187bb086203a105cf850785","observation_id":"10e3932f-2757-4dfe-8dd2-26af02afacc3","resolution":{"observed_at":"2026-08-02T06:52:28.101670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.15804","last_updated":"2026-04-21T03:35:14Z","snapshot_observed_at":"2026-08-14T13:05:43.952056Z","submitted_at":"2026-04-17T08:05:46Z","title":"Qwen3.5-Omni Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.15804","snapshot_observed_at":"2026-08-02T06:52:28.397659Z","title":"Qwen3.5-omni technical report.arXiv preprint arXiv:2604.15804,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:28.397659Z"},"links":{"cited_paper":"/paper/2604.15804","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:01458adf4c4d608b02fb6818f76c91c1d3bd3dabaa730386f5aa1c508a00efad","observation_id":"bc0895e3-660e-446f-80fe-69b20ceec219","resolution":{"observed_at":"2026-08-02T06:52:28.397659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05139","last_updated":"2025-02-07T18:15:57Z","snapshot_observed_at":"2026-08-20T12:00:11.254046Z","submitted_at":"2025-02-07T18:15:57Z","title":"Meta Audiobox Aesthetics: Unified Automatic Quality Assessment for Speech, Music, and Sound","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05139","snapshot_observed_at":"2026-08-02T06:52:28.474678Z","title":"Meta audiobox aesthetics: Unified automatic quality assessment for speech, music, and sound.arXiv preprint arXiv:2502.05139,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:28.474678Z"},"links":{"cited_paper":"/paper/2502.05139","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:4b85cd5ff67b161819eba2ec5a510a7bc850701bbb6fc3ec5e1a600aeed0f8fc","observation_id":"a7364586-1828-4d08-9fb9-01abebc82654","resolution":{"observed_at":"2026-08-02T06:52:28.474678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:52:28.543895Z","title":"Back to ear: Perceptually driven high fidelity music reconstruction.arXiv preprint arXiv:2509.14912,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:28.543895Z"},"links":{"citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:d6f76ed1e44508a390ed24023676bcad78c418ecd006a630da3479c2063f0a8f","observation_id":"a32c2848-ca08-493d-a7be-adc09f80a159","resolution":{"observed_at":"2026-08-02T06:52:28.543895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.25937","last_updated":"2026-04-16T04:26:34Z","snapshot_observed_at":"2026-08-15T16:06:56.859743Z","submitted_at":"2026-04-16T04:26:34Z","title":"SongBench: A Fine-Grained Multi-Aspect Benchmark for Song Quality Assessment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.25937","snapshot_observed_at":"2026-08-02T06:52:28.591985Z","title":"Songbench: A fine-grained multi-aspect benchmark for song quality assessment.arXiv preprint arXiv:2604.25937,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:28.591985Z"},"links":{"cited_paper":"/paper/2604.25937","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:b6e06de250c59ea4b7a86e43988530d4986327dd61065644809cf2e8c9d00fc8","observation_id":"b7f4dc51-e9e7-46e6-96c8-34d9a0ac4e34","resolution":{"observed_at":"2026-08-02T06:52:28.591985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.10547","last_updated":"2026-07-07T07:53:42Z","snapshot_observed_at":"2026-08-19T20:36:10.912206Z","submitted_at":"2026-01-15T16:14:25Z","title":"HeartMuLa: A Family of Open Sourced Music Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.10547","snapshot_observed_at":"2026-08-02T06:52:28.667227Z","title":"Heartmula: A family of open sourced music foundation models.arXiv preprint arXiv:2601.10547,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:28.667227Z"},"links":{"cited_paper":"/paper/2601.10547","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:8ea43046386b380dbf740cfbaf3e4895555dd9e2e4173e6b49e9b40aaba226b6","observation_id":"81203fa9-1779-48c3-8e26-d1acafd7ec34","resolution":{"observed_at":"2026-08-02T06:52:28.667227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10793","last_updated":"2025-05-16T02:06:25Z","snapshot_observed_at":"2026-08-20T10:52:40.332252Z","submitted_at":"2025-05-16T02:06:25Z","title":"SongEval: A Benchmark Dataset for Song Aesthetics Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10793","snapshot_observed_at":"2026-08-02T06:52:28.725371Z","title":"Songeval: A benchmark dataset for song aesthetics evaluation.arXiv preprint arXiv:2505.10793,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:28.725371Z"},"links":{"cited_paper":"/paper/2505.10793","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:9af95fa2450fdacd41334128a2f890961532beeb887acc24a25531b629709b3d","observation_id":"7c860c05-7d84-4492-9d11-ba3b9152b5ff","resolution":{"observed_at":"2026-08-02T06:52:28.725371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:52:28.778551Z","title":"Yue: Scaling open foundation models for long-form music generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:28.778551Z"},"links":{"citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:67fae61b0cdfe041e38b54ea4524a67577c88713140f47b5a5c906061be1ef3e","observation_id":"3ed2e451-8b26-4ec4-8d66-0bb28c7f07c4","resolution":{"observed_at":"2026-08-02T06:52:28.778551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05176","last_updated":"2025-06-11T02:54:49Z","snapshot_observed_at":"2026-08-20T02:29:37.867282Z","submitted_at":"2025-06-05T15:49:48Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05176","snapshot_observed_at":"2026-08-02T06:52:28.883735Z","title":"Qwen3 embedding: Advancing text embedding and reranking through foundation models.arXiv preprint arXiv:2506.05176,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:28.883735Z"},"links":{"cited_paper":"/paper/2506.05176","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:3be63a05778d76e7a2882e2ead6b0f4552845b3095be05ddb706f8f956b7d8db","observation_id":"78e76294-9ff3-481e-a4c0-28b801b51ec9","resolution":{"observed_at":"2026-08-02T06:52:28.883735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18071","last_updated":"2025-07-28T11:11:33Z","snapshot_observed_at":"2026-08-15T00:49:38.146652Z","submitted_at":"2025-07-24T03:50:32Z","title":"Group Sequence Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.18071","snapshot_observed_at":"2026-08-02T06:52:28.950800Z","title":"Group sequence policy optimization.arXiv preprint arXiv:2507.18071,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:28.950800Z"},"links":{"cited_paper":"/paper/2507.18071","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:7318e98781395473163aa4b27511a92412dadb89cf792f4a8568ff0d17cb5e7e","observation_id":"213f2433-dc4c-48aa-81b5-778a92000111","resolution":{"observed_at":"2026-08-02T06:52:28.950800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:52:26.342000Z","title":"Musicldm: Enhancing novelty in text-to-music generation using beat-synchronous mixup strategies","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:26.342000Z"},"links":{"citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:17b3c165b637d1653b206a014d5c9a6b8df8a9ff6df639a084117a363a609ba1","observation_id":"2c16fcea-2e42-45e3-bbf2-6648f6fd96be","resolution":{"observed_at":"2026-08-02T06:52:26.342000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:52:27.162263Z","title":"URLhttps://doi.org/10.1145/1143844.1143891","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:27.162263Z"},"links":{"citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:ef9a611265cc545b16049481bffeaa4e66f7a84279418bca949f8292b5e49e52","observation_id":"da842d12-1a11-4296-806a-1abc9ed01200","resolution":{"observed_at":"2026-08-02T06:52:27.162263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:52:27.574973Z","title":"Diffrhythm 2: Efficient and high fidelity song generation via block flow matching.arXiv preprint arXiv:2510.22950,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:27.574973Z"},"links":{"citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:10e6fdd35fbafd690493912bb95332a08ce249ed770cf455b638d1952b236e56","observation_id":"3c70aeef-b792-4946-bf5a-989bacfc84ce","resolution":{"observed_at":"2026-08-02T06:52:27.574973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01183","last_updated":"2025-03-03T05:15:34Z","snapshot_observed_at":"2026-08-18T09:40:58.694553Z","submitted_at":"2025-03-03T05:15:34Z","title":"DiffRhythm: Blazingly Fast and Embarrassingly Simple End-to-End Full-Length Song Generation with Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01183","snapshot_observed_at":"2026-08-02T06:52:28.236537Z","title":"Diffrhythm: Blazingly fast and embarrassingly simple end-to-end full-length song generation with latent diffusion.arXiv preprint arXiv:2503.01183,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:28.236537Z"},"links":{"cited_paper":"/paper/2503.01183","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:8cb74fc53ff22212b01a13714f9a9546bc03e568c90cd4452194da523e2f21d6","observation_id":"cb0fa44a-4602-4cce-8453-87f791f56456","resolution":{"observed_at":"2026-08-02T06:52:28.236537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:52:27.329887Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:27.329887Z"},"links":{"citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:928cb903c08da44639f255437d71777bd43e4ee811a97489bfff9c0a524aca17","observation_id":"2edafa81-ad0e-4bc1-a9de-df451890ecf6","resolution":{"observed_at":"2026-08-02T06:52:27.329887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-02T06:52:26.485333Z","title":"Gheorghe Comanici, Eric Bieber, Mike Schaekermann, Ice Pasupat, Noveen Sachdeva, Inderjit Dhillon, Marcel Blistein, Ori Ram, Dan Zhang, Evan Rosen, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:26.485333Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:ac9051c873380482bd2556962b66f7251895422a131264c777793d8149aefdd8","observation_id":"c20ac212-449e-4f2f-b21f-a32c1b0f15e1","resolution":{"observed_at":"2026-08-02T06:52:26.485333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21337","last_updated":"2026-01-30T02:58:48Z","snapshot_observed_at":"2026-08-13T02:49:58.912820Z","submitted_at":"2026-01-29T06:58:13Z","title":"Qwen3-ASR Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.21337","snapshot_observed_at":"2026-08-02T06:52:28.344511Z","title":"Qwen3-asr technical report.arXiv preprint arXiv:2601.21337,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:28.344511Z"},"links":{"cited_paper":"/paper/2601.21337","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:982b072e3b38c0372bce4c5777eb22c45a33cd3dd6c756cfbaf54f2fa0f6f99c","observation_id":"6ed24ab2-1ee2-400f-9549-cc35a86c2a42","resolution":{"observed_at":"2026-08-02T06:52:28.344511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13438","last_updated":"2022-10-24T17:52:02Z","snapshot_observed_at":"2026-08-15T04:43:16.361751Z","submitted_at":"2022-10-24T17:52:02Z","title":"High Fidelity Neural Audio Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13438","snapshot_observed_at":"2026-08-02T06:52:26.566308Z","title":"High fidelity neural audio compression","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:26.566308Z"},"links":{"cited_paper":"/paper/2210.13438","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:87362db51cbd8a026aadd4fb4cb3652fb685d4e49f0f1bb1f37086d7585b5aff","observation_id":"8a252e5e-9011-494e-8d0e-3021419ed9a0","resolution":{"observed_at":"2026-08-02T06:52:26.566308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:52:27.017158Z","title":"Ace-step 1.5: Pushing the boundaries of open-source music generation.arXiv preprint arXiv:2602.00744,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:27.017158Z"},"links":{"citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:591d76de3df3fa995ebce3277d3e7bbcb6ae444c48920083a9238111802b9fd2","observation_id":"0844cf8c-c8c1-40f8-8d0d-9bf35f31bded","resolution":{"observed_at":"2026-08-02T06:52:27.017158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18613","last_updated":"2026-05-18T16:23:16Z","snapshot_observed_at":"2026-08-15T06:26:48.573621Z","submitted_at":"2026-05-18T16:23:16Z","title":"SAME: A Semantically-Aligned Music Autoencoder","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18613","snapshot_observed_at":"2026-08-02T06:52:28.298503Z","title":"William Peebles and Saining Xie","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:28.298503Z"},"links":{"cited_paper":"/paper/2605.18613","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:26c6f32c76559af72de7c6cc1e2c140a484829cbd14016161a69f5b872062158","observation_id":"ec0df292-a9c6-4338-8012-b284af50115e","resolution":{"observed_at":"2026-08-02T06:52:28.298503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-20T22:01:45.892394Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 1 inbound Pith citation observation for arXiv:2607.11699."}