{"as_of":"2026-08-08T06:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6c321ecc1028c9da587aa543402d9d94e9763ee7ea66e4b8c3e0be41784b4142","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:22:38.690512Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.02661/citation-record","integrity":"/paper/2506.02661/integrity","json":"/paper/2506.02661/citation-record.json","paper":"/paper/2506.02661"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.385798Z","title":"Self-supervised multimodal versatile networks.Advances in neural information processing systems, 33:25–37, 2020","venue":null,"work_id":"e245ffac-bc35-4061-8879-04c4306ca8aa","year":2020},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.499766Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:4e0ea8bfb169fae3bbe4b959ea2c1af83f3ac70442b712202fbfd8ebf0d41e02","observation_id":"fb2507d4-5399-46d1-a3e5-895461ac0b74","resolution":{"observed_at":"2026-08-07T11:22:39.390840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.365767Z","title":"Groovenet: Real-time music-driven dance movement generation using artificial neural networks.networks, 8(17):26, 2017","venue":null,"work_id":"1d91ef15-2b60-4690-b416-2ffd75ba74bf","year":2017},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.505300Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:366b4be07de8c97453fb2bbdc036ce6699cb4cf8e28b4ec609e83f7fa3da231e","observation_id":"50205bbb-7099-482d-b56c-3479fd633f24","resolution":{"observed_at":"2026-08-07T11:22:39.370981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.509903Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations.Advances in neural information processing systems, 33:12449–12460, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.509903Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:14bb732787109e407d5a21462829aa57dcc228f4e69f95cc319ce79af863d061","observation_id":"bdd53ff5-8839-43e8-8b16-24c4b3692607","resolution":{"observed_at":"2026-08-07T11:22:38.509903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.330398Z","title":"Choreomaster: choreography-oriented music-driven dance synthesis.ACM Transactions on Graphics (TOG), 40(4):1–13, 2021","venue":null,"work_id":"45651e18-f706-48d1-9666-519049adc051","year":2021},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.514737Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:86b4d31e6741387d0677b7b0a5a12ee1efb7ef25fb666ba64633d387efb0b7e4","observation_id":"a3a1a65d-ce63-44d1-aeb6-45d0d1c58080","resolution":{"observed_at":"2026-08-07T11:22:39.335146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00341","last_updated":"2020-04-30T09:02:45Z","snapshot_observed_at":"2026-08-06T03:57:57.420510Z","submitted_at":"2020-04-30T09:02:45Z","title":"Jukebox: A Generative Model for Music","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00341","snapshot_observed_at":"2026-08-07T11:22:38.520386Z","title":"Jukebox: A generative model for music.arXiv preprint arXiv:2005.00341, 2020","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.520386Z"},"links":{"cited_paper":"/paper/2005.00341","citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:de278acdfbec93fd8365618e379171f56c5888cb34a000d3f82a96936a008d00","observation_id":"64ae1e95-b6e5-4758-afbb-cd1191249091","resolution":{"observed_at":"2026-08-07T11:22:38.520386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.314572Z","title":"Fairmotion-tools to load, process and visualize motion capture data","venue":null,"work_id":"4fd6c2f6-e580-41d0-996b-8f77e28bdd50","year":2020},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.525335Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:d1e9497f651a1aca27f0fceb2b9a5f44056cbc25da4ece6ffe84b053bf5d0abb","observation_id":"6772eb54-85d4-4f24-b097-1222bc17b15d","resolution":{"observed_at":"2026-08-07T11:22:39.319568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.298837Z","title":"Momask: Generative masked modeling of 3d human motions","venue":null,"work_id":"1d078e38-2c80-4e6a-925c-2904740dca51","year":1900},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.530549Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:ade20d8559f861828b3c030685618494bd026a03cca83dd17553b9b22f2ae4d4","observation_id":"9036d2a9-f955-4555-adb8-82286a51b63e","resolution":{"observed_at":"2026-08-07T11:22:39.303839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.535432Z","title":"Denoising diffusion probabilistic models.Advances in neural information processing systems, 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.535432Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:b38a316fa3f4dfb7ea298bd09a0d313162a0138903d4db54adb37606c6ea50ee","observation_id":"240ed977-c77c-4b16-bc4f-4b0a08345081","resolution":{"observed_at":"2026-08-07T11:22:38.535432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.267959Z","title":"Dance revolution: Long-term dance generation with music via curriculum learning","venue":null,"work_id":"9b04bffa-901a-4d47-b720-54569c3f87ca","year":2020},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.539745Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:c6028eeebb86ede5e9582b67381015b726d16e1b5ef6204f9fb2f2d425e57599","observation_id":"bc03ab71-0868-4b46-8d59-f4ce617afa04","resolution":{"observed_at":"2026-08-07T11:22:39.273104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.250928Z","title":"Beat-it: Beat-synchronized multi-condition 3d dance generation","venue":null,"work_id":"721d933e-a2d0-479f-a89d-e95956b78b4c","year":2024},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.543890Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:30277a868ab6720d18c099e3d23f02185dd133df946c36f7893e5e4cb209a113","observation_id":"1f41453d-0df8-4081-ab4a-b2b0d89cf947","resolution":{"observed_at":"2026-08-07T11:22:39.256298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.234283Z","title":"Morag - multi- fusion retrieval augmented generation for human motion","venue":null,"work_id":"c9d61882-cd72-4768-bf17-a8fb227b7337","year":2025},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.548240Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:bd1bf0057f59be293faa300da640be18ff437bf85a0cbbebd624a0e65ef38052","observation_id":"85081c4a-d390-47af-93c2-bd5db3735bf0","resolution":{"observed_at":"2026-08-07T11:22:39.239858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.217712Z","title":"A brand new dance partner: Music-conditioned pluralistic dancing controlled by multiple dance genres","venue":null,"work_id":"3d0de434-1bc1-46d2-aabc-2cf3008832ed","year":2022},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.552952Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:996c182f46109b90bcd5c85fb77c957d9c3fedced619e5dbdac3760ea4f4f844","observation_id":"3619ce15-53a9-4e13-adbc-63e2e414871d","resolution":{"observed_at":"2026-08-07T11:22:39.222628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.202335Z","title":"Exponential moving average versus moving exponential average.Mathematische Semesterberichte, 58:97–107, 2011","venue":null,"work_id":"4cd4a262-2799-4da2-b06b-8e02c99c66dd","year":2011},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.557343Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:2ab35bb9418497a77de2fad29c1b723ff05d9bfc079ccc7b59122da544bdc6b3","observation_id":"849fd0c6-88b6-4381-a5d0-29159d5db163","resolution":{"observed_at":"2026-08-07T11:22:39.206721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.187700Z","title":"Danceformer: Music conditioned 3d dance generation with parametric motion transformer","venue":null,"work_id":"09b167a4-928e-4472-84de-0c9bb88bdce3","year":2022},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.562403Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:2e9293e7c4a6ea4c8218a86bb28142a597030c6dcb1f5911e5f2757dc805a0e4","observation_id":"fd3bb071-4218-4e9c-b8ae-bed144e66e13","resolution":{"observed_at":"2026-08-07T11:22:39.192158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.08171","last_updated":"2020-08-18T22:29:40Z","snapshot_observed_at":"2026-07-06T09:48:15.927807Z","submitted_at":"2020-08-18T22:29:40Z","title":"Learning to Generate Diverse Dance Motions with Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.08171","snapshot_observed_at":"2026-08-07T11:22:38.570255Z","title":"Learning to generate diverse dance motions with transformer.arXiv preprint arXiv:2008.08171, 2020","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.570255Z"},"links":{"cited_paper":"/paper/2008.08171","citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:d410b023c677151ca16cd3519a6f10c06cd87dfff2ae164327910415a3ccb848","observation_id":"d59b9d7a-e761-419e-8d9b-9d08e403a78d","resolution":{"observed_at":"2026-08-07T11:22:38.570255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20389","last_updated":"2024-10-27T09:32:35Z","snapshot_observed_at":"2026-07-06T19:40:17.497219Z","submitted_at":"2024-10-27T09:32:35Z","title":"Lodge++: High-quality and Long Dance Generation with Vivid Choreography Patterns","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20389","snapshot_observed_at":"2026-08-07T11:22:38.575805Z","title":"Lodge++: High-quality and long dance generation with vivid choreography patterns.arXiv preprint arXiv:2410.20389, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.575805Z"},"links":{"cited_paper":"/paper/2410.20389","citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:10a701c4a221cebe3eab5ad0d40f20acb7214c2003c52ebeab9ebd9f84411484","observation_id":"726d463b-dfa4-4921-9666-fbd00f5c4831","resolution":{"observed_at":"2026-08-07T11:22:38.575805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.171887Z","title":"Lodge: A coarse to fine diffusion network for long dance generation guided by the characteristic dance primitives","venue":null,"work_id":"a8f35696-2278-427e-862d-8aea6bb9b876","year":2024},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.580755Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:de82cb55c0622b2d2e538ee9536dd3790cb4113512d9c1c605c1998740ae5046","observation_id":"196e7b6d-b2ab-4154-b6f7-8a74373af1ab","resolution":{"observed_at":"2026-08-07T11:22:39.176968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.156331Z","title":"Finedance: A fine-grained choreography dataset for 3d full body dance generation","venue":null,"work_id":"64726750-6e62-452e-ab85-c96357613e29","year":2023},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.585082Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:8c030340807f82553de2a8e0eb49b22f34a6f13077e2f31d234fa772925e8488","observation_id":"a5f77e4b-06a4-47c9-bd25-2dc40eedbd5b","resolution":{"observed_at":"2026-08-07T11:22:39.160919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.140173Z","title":"Ai choreographer: Music conditioned 3d dance generation with aist++","venue":null,"work_id":"335453b7-51b9-4a2b-a191-0fb2d6d45bd8","year":2021},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.589436Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:88ca8639835ede9c42e878c823e3baa612b98ad5092ea37de70b34672ce5bd91","observation_id":"839ff4ce-5ad9-4250-8adc-f0cb81030d3a","resolution":{"observed_at":"2026-08-07T11:22:39.145515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20218","last_updated":"2025-06-03T02:25:16Z","snapshot_observed_at":"2026-08-07T16:36:41.093177Z","submitted_at":"2025-03-26T04:20:14Z","title":"Video Motion Graphs","version":2},"cited_work":{"arxiv_id":"2503.20218","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.20218","snapshot_observed_at":"2026-08-07T11:22:38.784139Z","title":"Video Motion Graphs","venue":"cs.CV","work_id":"14d93a20-7615-4505-a538-80a71dccc403","year":2025},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.594025Z"},"links":{"cited_paper":"/paper/2503.20218","citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:693adaa284b62c1b19128ff3fae0faca590bace1082f0028368f092a05b6f953","observation_id":"746e3de8-8b91-4991-813b-9a5ca6094f75","resolution":{"observed_at":"2026-08-07T11:22:38.791379Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04221","last_updated":"2024-10-05T16:30:46Z","snapshot_observed_at":"2026-07-06T19:28:26.436468Z","submitted_at":"2024-10-05T16:30:46Z","title":"TANGO: Co-Speech Gesture Video Reenactment with Hierarchical Audio Motion Embedding and Diffusion Interpolation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04221","snapshot_observed_at":"2026-08-07T11:22:38.599410Z","title":"Tango: Co-speech gesture video reenactment with hierarchical audio motion embedding and diffusion interpolation.arXiv preprint arXiv:2410.04221, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.599410Z"},"links":{"cited_paper":"/paper/2410.04221","citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:6d00cbd9c37f8e0040654dfaddf4f2f3ed114cbc0e63213fa48a2dcc5c06fc92","observation_id":"5c6eb645-3586-49ee-8797-43e93e7a6763","resolution":{"observed_at":"2026-08-07T11:22:38.599410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.604173Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.604173Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:5337a5939cb16f18babd7d65587b4d94334b27a2381ae6a74f97b1059f12e5e1","observation_id":"7e800d0f-8208-4e91-b523-5ce747aba6a3","resolution":{"observed_at":"2026-08-07T11:22:38.604173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T11:22:38.608414Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.608414Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:94f8d367a120102554ab52470f47b6fc058b2fadfb6775d94b9d39ba20928bf1","observation_id":"6e3b6318-3417-42e6-9cb0-accadc799057","resolution":{"observed_at":"2026-08-07T11:22:38.608414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.114965Z","title":"librosa: Audio and music signal analysis in python.SciPy, 2015:18–24, 2015","venue":null,"work_id":"7a2bcd19-7b64-41f8-ab34-1991daa465b7","year":2015},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.613414Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:b9582acc01d7073acc8ac0992182d7ff8e94be783e23525b4c220d9b27525c7c","observation_id":"edbe79aa-6b2e-412e-b9d1-374cfe7d8bf0","resolution":{"observed_at":"2026-08-07T11:22:39.119475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.099716Z","title":"Learn2dance: Learning statistical music-to-dance mappings for choreography synthesis.IEEE Transactions on Multimedia, 14(3):747–759, 2011","venue":null,"work_id":"b3612e2c-f745-4a70-88e5-0f418b10e057","year":2011},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.618013Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:c85bc2c168d5256fcb2e5c66f1ab4fa7b8c53d98ce6a09a94f1673cc73ed01c3","observation_id":"53a6e95e-b1c7-40cf-8b3f-9950b197775b","resolution":{"observed_at":"2026-08-07T11:22:39.104257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.622516Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.622516Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:3c403bdfdcb4846b273d90250cd2b4abe39f0042d26caf0e8118163ba23dd0f1","observation_id":"cfd0e2f8-dd04-4667-98ed-5113c62bd3f3","resolution":{"observed_at":"2026-08-07T11:22:38.622516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.626976Z","title":"Film: Visual reasoning with a general conditioning layer","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.626976Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:d04595be6614785940c7d2126e35d6348df54062b8cb0d0b350162dcc8e0f551","observation_id":"5268d9fd-dd53-48f5-b57e-356f9defff10","resolution":{"observed_at":"2026-08-07T11:22:38.626976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.062840Z","title":"Diffdance: Cascaded human motion diffusion model for dance generation","venue":null,"work_id":"7c34b33f-4164-476e-aa6e-9eb754b880c1","year":2023},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.631323Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:a4f5eb2c22abf3c8f519a84b272259d1e3f57594d1b4a042e1d60a721ea8ae29","observation_id":"928cb026-de76-4a1d-9c52-ae2fda53224c","resolution":{"observed_at":"2026-08-07T11:22:39.067507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.635595Z","title":"Bailando: 3d dance generation via actor-critic gpt with choreographic memory","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.635595Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:8399700916cf7797faecfafaae6b70fb918f958a715df5d6ec60fd4088ecd5a6","observation_id":"b756487f-de10-42f9-8a28-a0b68ebfa831","resolution":{"observed_at":"2026-08-07T11:22:38.635595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.034862Z","title":"Bailando++: 3d dance gpt with choreographic memory.IEEE Transactions on Pattern Analysis and Machine Intelligence, 45(12):14192–14207, 2023","venue":null,"work_id":"aba2f3a5-35dd-4cb6-a6bb-b69a5322ae5e","year":2023},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.639824Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:ba4141229f84e56cf733e1135b41e7ea51a892f07d4c188bc51b97aea870bc11","observation_id":"cc9fe848-831f-4382-804e-68b65220beb4","resolution":{"observed_at":"2026-08-07T11:22:39.040014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.644047Z","title":"Deep unsuper- vised learning using nonequilibrium thermodynamics","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.644047Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:e0005959447c91c8cbe5855debe88b34d839be30b94e8fcee1c236469e3d0d43","observation_id":"c1a83ddf-c92f-4b2c-99bc-4668c851ad6b","resolution":{"observed_at":"2026-08-07T11:22:38.644047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:39.006203Z","title":"Dance with melody: An lstm-autoencoder approach to music-oriented dance synthesis","venue":null,"work_id":"c66e72d1-a498-4fc8-b994-1426d671b012","year":2018},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.648769Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:55327727456bbc9b0ed50db5e15f6d89990257cc13212eaa88ddfcd500bcdaa2","observation_id":"2721de05-f17a-47f4-92ba-dd1ce3bf9045","resolution":{"observed_at":"2026-08-07T11:22:39.011501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.986047Z","title":"Motionclip: Exposing human motion generation to clip space","venue":null,"work_id":"7a6d37bd-7d39-498a-a8af-5040640d4528","year":2022},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.652939Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:a788cc358d83b992e4fc253d9a644dce659c229cfa105a6d973dd60140af786a","observation_id":"529c249e-c484-4e93-9b2c-cfb813775223","resolution":{"observed_at":"2026-08-07T11:22:38.991554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14916","last_updated":"2022-10-03T09:17:41Z","snapshot_observed_at":"2026-07-06T13:57:50.746457Z","submitted_at":"2022-09-29T16:27:53Z","title":"Human Motion Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14916","snapshot_observed_at":"2026-08-07T11:22:38.657037Z","title":"Human motion diffusion model.arXiv preprint arXiv:2209.14916, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.657037Z"},"links":{"cited_paper":"/paper/2209.14916","citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:e583c4e7a5e394d2ff649d6fb4f07594a8e3b5af3bdb33e988d2466da7393c09","observation_id":"07bb34a3-8d47-4673-9033-c4cd58797665","resolution":{"observed_at":"2026-08-07T11:22:38.657037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.969682Z","title":"Edge: Editable dance generation from music","venue":null,"work_id":"a8ab1850-7e03-467d-b5fb-7e418564e891","year":2023},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.661324Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:36dfef18ddbc1860018f29d0d7d849c4c89a4553f710cebc3516c375dbb15d89","observation_id":"365b4e1f-b30a-4b21-9144-33ed2c9e5508","resolution":{"observed_at":"2026-08-07T11:22:38.974605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.952369Z","title":"Wav2clip: Learning robust audio representations from clip","venue":null,"work_id":"2f20753c-355a-4222-b590-971e6399711a","year":2022},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.665669Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:3dc8c1224039ee8f5cd88b87acc23cccebb9c6c9f1bda902b786bf2488e655ec","observation_id":"5cd822e8-01a9-4cee-a86a-f77807185c42","resolution":{"observed_at":"2026-08-07T11:22:38.957681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.933087Z","title":"Adan: Adaptive nesterov momentum algorithm for faster optimizing deep models.IEEE Transactions on Pattern Analysis and Machine Intelligence, 2024","venue":null,"work_id":"c715ee91-192d-4531-9616-add3d0a0a9ec","year":2024},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.672894Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:1c9db2b2c0103d772e094402d41ef2b0e87e4689f4eadd16d0451b3e2bcdffb5","observation_id":"363244fa-e989-48a0-a475-e6473cd06a0b","resolution":{"observed_at":"2026-08-07T11:22:38.939181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.677124Z","title":"Motiondiffuse: Text-driven human motion generation with diffusion model.IEEE transactions on pattern analysis and machine intelligence, 46(6):4115–4128, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.677124Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:8329141c1c2e6b58bb5af1a9cd2e7670a57f0c847003c4ae6035afdf85a72190","observation_id":"b68f4e48-5228-420d-a54a-1ecc46acc021","resolution":{"observed_at":"2026-08-07T11:22:38.677124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.681325Z","title":"Remodiffuse: Retrieval-augmented motion diffusion model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.681325Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:8d38eedfa02ddbf257162974cd8f1b0fb00e116d6c478f77370ae896e93e970e","observation_id":"aad516c7-c65f-4655-8b22-5a351cb2085c","resolution":{"observed_at":"2026-08-07T11:22:38.681325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.884936Z","title":"Audio-driven neural gesture reenactment with video motion graphs","venue":null,"work_id":"913e1037-51ac-4377-9976-93e5bd4bddcd","year":2022},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.686256Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:c146eed43c903d83a0f65a7a10b254ff2ca2a5ca77fbddffd695a46d9f1a3455","observation_id":"e1e1c965-c815-433c-b4af-846a16f2cb3a","resolution":{"observed_at":"2026-08-07T11:22:38.889676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:22:38.867393Z","title":"Music2dance: Dancenet for music-driven dance generation.ACM Transactions on Multimedia Computing, Communications, and Applications (TOMM), 18(2):1–21, 2022","venue":null,"work_id":"ba4866ec-77c6-47dd-8b7c-0ceb28a5668c","year":2022},"citing_paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:22:38.690512Z"},"links":{"citing_paper":"/paper/2506.02661"},"observation_digest":"sha256:1b3e4e936596510512be4e4767c78c920f4199d8c88ef0d8d0f7ca0437df0f20","observation_id":"4ad6df18-ec72-4094-b48b-d2c0f0a87e22","resolution":{"observed_at":"2026-08-07T11:22:38.873745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.02661","last_updated":"2025-06-03T09:12:48Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T11:16:39.682370Z","submitted_at":"2025-06-03T09:12:48Z","title":"MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":1,"verified_fuzzy":25},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2506.02661."}