{"as_of":"2026-08-08T17:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fe4d4ba95f3f8693c4eacaf2a2a5520d3a32c34bb3240fc5aa09840951b1aebf","coverage":[{"denominator":193,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:30:20.017675Z","state":"measured"},{"denominator":105,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":105,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T17:30:19.672312Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:39:57.259001Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05419","snapshot_observed_at":"2026-08-03T17:30:19.672312Z","title":"Motion generation: A survey of generative approaches and benchmarks.arXiv preprint arXiv:2507.05419, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.09423","last_updated":"2026-07-03T09:29:55Z","snapshot_observed_at":"2026-08-08T09:19:00.760092Z","submitted_at":"2025-12-10T08:46:53Z","title":"FunPhase: A Periodic Functional Autoencoder for Motion Generation via Phase Manifolds","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T17:30:19.672312Z"},"links":{"cited_paper":"/paper/2507.05419","citing_paper":"/paper/2512.09423"},"observation_digest":"sha256:5243fa7cbba91ec972bee982f24d01961aad2058614714c2fc0c540028074fea","observation_id":"6a930fb2-672b-4cbe-baf6-c27ce517d4ec","resolution":{"observed_at":"2026-08-03T17:30:19.672312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05419","snapshot_observed_at":"2026-08-03T17:06:55.658962Z","title":"Motion generation: A survey of generative approaches and benchmarks.arXiv preprint arXiv:2507.05419, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10730","last_updated":"2026-07-04T09:34:06Z","snapshot_observed_at":"2026-08-06T22:04:38.705956Z","submitted_at":"2025-12-11T15:16:06Z","title":"IRG-MotionLLM: Interleaving Motion Generation, Assessment and Refinement for Text-to-Motion Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T17:06:55.658962Z"},"links":{"cited_paper":"/paper/2507.05419","citing_paper":"/paper/2512.10730"},"observation_digest":"sha256:6af282bb5623408d631494c2fe06fcc94577120780f76608f0e4fba93ebdc451","observation_id":"a64a0d08-fc20-43ae-afdb-ddab3a0ab605","resolution":{"observed_at":"2026-08-03T17:06:55.658962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"cited_work":{"arxiv_id":"2507.05419","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.05419","snapshot_observed_at":"2026-07-04T16:39:57.259001Z","title":"Motion generation: A survey of gen- erative approaches and benchmarks","venue":null,"work_id":"ef409ca0-94fc-4122-aee3-90506997f5e0","year":2025},"citing_paper":{"arxiv_id":"2604.08088","last_updated":"2026-04-09T11:05:29Z","snapshot_observed_at":"2026-07-31T17:49:55.022312Z","submitted_at":"2026-04-09T11:05:29Z","title":"Coordinate-Based Dual-Constrained Autoregressive Motion Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T17:10:18.316772Z"},"links":{"cited_paper":"/paper/2507.05419","citing_paper":"/paper/2604.08088"},"observation_digest":"sha256:feaa3f5af701106b3252d9c7b30b6ff04809903355b701c1e7626b50939d0f82","observation_id":"aa1136c6-1eab-4c56-9f2f-8fab385d917f","resolution":{"observed_at":"2026-05-11T07:26:03.349605Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"cited_work":{"arxiv_id":"2507.05419","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.05419","snapshot_observed_at":"2026-07-04T16:39:57.259001Z","title":"Motion generation: A survey of gen- erative approaches and benchmarks","venue":null,"work_id":"ef409ca0-94fc-4122-aee3-90506997f5e0","year":2025},"citing_paper":{"arxiv_id":"2606.24255","last_updated":"2026-06-23T07:43:13Z","snapshot_observed_at":"2026-08-08T08:36:10.493902Z","submitted_at":"2026-06-23T07:43:13Z","title":"Social Structure Matters in 3D Human-Human Interaction Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T00:26:51.099406Z"},"links":{"cited_paper":"/paper/2507.05419","citing_paper":"/paper/2606.24255"},"observation_digest":"sha256:08a071b3089bd1a057bd8a090cd4c280e2b7a77331ebd3344d6ed9c82dd02947","observation_id":"4ccc82ff-96cc-49d0-a480-24c2bbaad8c4","resolution":{"observed_at":"2026-07-04T16:39:57.260524Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"cited_work":{"arxiv_id":"2507.05419","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.05419","snapshot_observed_at":"2026-07-04T16:39:57.259001Z","title":"Motion generation: A survey of gen- erative approaches and benchmarks","venue":null,"work_id":"ef409ca0-94fc-4122-aee3-90506997f5e0","year":2025},"citing_paper":{"arxiv_id":"2606.30266","last_updated":"2026-06-29T13:14:57Z","snapshot_observed_at":"2026-08-07T07:03:01.028212Z","submitted_at":"2026-06-29T13:14:57Z","title":"Towards Continual Motion-Language Agents: LoRA Variants for Incremental Motion Understanding and Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T07:36:50.034451Z"},"links":{"cited_paper":"/paper/2507.05419","citing_paper":"/paper/2606.30266"},"observation_digest":"sha256:da09847be67e5391aacd3800068052813c5024002625f04448a6c21c0b3d1cd1","observation_id":"e7eb131d-f5f3-4249-ad6b-adb59bff84c4","resolution":{"observed_at":"2026-06-30T08:04:28.955382Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.05419/citation-record","integrity":"/paper/2507.05419/integrity","json":"/paper/2507.05419/citation-record.json","paper":"/paper/2507.05419"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:10.756010Z","title":"Unpaired motion style transfer from video to animation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:10.756010Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:5ab81a7fc8e9fc9a1b5b44de6fee7d1a9ae89d6b39090dc3889d0058f90a4e92","observation_id":"87cf6269-5f73-4544-8f1a-2548deb8ca93","resolution":{"observed_at":"2026-08-06T19:30:10.756010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:10.828591Z","title":"Skel-betweener: a neural motion rig for interactive motion authoring","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:10.828591Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:35a38175ae47e8e259841006792ae054da13f47fce7aadbc0be78a2e91c0c32c","observation_id":"43012510-9758-4433-a555-024a02986196","resolution":{"observed_at":"2026-08-06T19:30:10.828591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:10.936919Z","title":"Text2action: Generative adversarial synthesis from language to action","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:10.936919Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:078cbac4fbc2a827db913c2780ac7d31f117fa0c47d18fc079acf44c0d49ffab","observation_id":"2d251bfd-1132-4de2-a551-a4322ded95a2","resolution":{"observed_at":"2026-08-06T19:30:10.936919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:11.074582Z","title":"Lan- guage2pose: Natural language grounded pose forecast- ing","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:11.074582Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:5455558a18b2027fae30e9a0db0bcbc0ebfb62a0a6c81e3e02ff30f7695db980","observation_id":"43e0cc8e-3a90-4ffd-a6d4-c9a6297020a8","resolution":{"observed_at":"2026-08-06T19:30:11.074582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:11.208531Z","title":"Hmd-nemo: Online 3d avatar motion generation from sparse obser- vations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:11.208531Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:c7f2a34760f5e4a71eaf2ee70d4f8db7a16746383eabca74a0ba52d142693df5","observation_id":"ab6e0882-c7bc-4a4e-828c-d762e9b6d173","resolution":{"observed_at":"2026-08-06T19:30:11.208531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:11.291651Z","title":"Lead: Latent realignment for human motion diffusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:11.291651Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:8e23fa43d9eff7ffc0bc190419460b2c4734382ff093b2b58413d90e7ccc2acd","observation_id":"0c68b4df-5dd8-4240-800f-f42a887d5cd7","resolution":{"observed_at":"2026-08-06T19:30:11.291651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:11.377982Z","title":"Circle: Capture in rich contextual environments","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:11.377982Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:741ee0854f45f5865f5bb6ffd186f015237833b038ee3ec7203d61cb7268929a","observation_id":"2a55bd2c-165a-49a6-9445-5e1948285120","resolution":{"observed_at":"2026-08-06T19:30:11.377982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:11.478301Z","title":"Emotion control of unstruc- tured dance movements","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:11.478301Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:5af5817c85482872a24d7b6c9cb045f84f78a966fb01a176f422a883f6531c51","observation_id":"6252a45e-d07a-4d89-ab69-4812c3f409b0","resolution":{"observed_at":"2026-08-06T19:30:11.478301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:11.583763Z","title":"Motionfix: Text-driven 3d human motion editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:11.583763Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:c2054c90f408c5d0e95bfb28b6395c3157a5f4802d1af80f05f857a1168c0c3b","observation_id":"4cd7a0a6-fb0d-4b7d-b761-afbb0b10147d","resolution":{"observed_at":"2026-08-06T19:30:11.583763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:11.712165Z","title":"Teach: Temporal action composition for 3d humans","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:11.712165Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:41f708e6a4542d103ba3d378522c03fc8e828e8d0f3c1c7be33f3a8a99bdd4c6","observation_id":"e06fbcd5-fc9d-4a23-affd-e7b83bfa6115","resolution":{"observed_at":"2026-08-06T19:30:11.712165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:11.819623Z","title":"Make-an-animation: Large- scale text-conditional 3d human motion generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:11.819623Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:5eadb75517092f44268c8a25794719df4f7557c147ce5629073adde714d4d3b1","observation_id":"3cc0e922-dd2a-410e-940f-52cb9ff65e45","resolution":{"observed_at":"2026-08-06T19:30:11.819623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:11.900587Z","title":"Versatile physics-based character control with hybrid latent representation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:11.900587Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:097125fa1b9913743007a4ab7fbb12809dd079c2cf65e91cfc9a640f2cc984aa","observation_id":"95caa401-c9e4-4c46-bb7c-d6296dcc15c5","resolution":{"observed_at":"2026-08-06T19:30:11.900587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:12.016692Z","title":"Belfusion: Latent diffusion for behavior- driven human motion prediction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:12.016692Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:64291c286f3659e9e575f9d436f1f065eb6f2980f54268b677fefda3c84559b7","observation_id":"c6c98301-24ef-4192-bba1-406c8db108fb","resolution":{"observed_at":"2026-08-06T19:30:12.016692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:12.088974Z","title":"Seamless human motion composition with blended positional encodings","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:12.088974Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:9f8a423cfa51568fb307b2546ef25f73a0b983a56fad4abe0f50e34bcb186392","observation_id":"038a1af5-ef54-467c-993d-05f7c37b97bc","resolution":{"observed_at":"2026-08-06T19:30:12.088974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:12.173542Z","title":"Bedlam: A synthetic dataset of bodies ex- hibiting detailed lifelike animated motion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:12.173542Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:9a437ffa42863cef629c588fb137f43edd6f6b1c5d8d3a10c5fa55ae8fbe080e","observation_id":"0e328d92-3a50-4e50-8156-68a16a779550","resolution":{"observed_at":"2026-08-06T19:30:12.173542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:12.302402Z","title":"Humman: Multi-modal 4d human dataset for versatile sensing and modeling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:12.302402Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:2f8e2ed3db298fd88c51cd5b78313d86f759ca5f81705bae8a4548db0600294d","observation_id":"3f1d0458-a54e-4263-b254-417109127989","resolution":{"observed_at":"2026-08-06T19:30:12.302402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:12.379145Z","title":"Gen- erating human motion in 3d scenes from text descrip- tions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:12.379145Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:02e3fef3e1fd3a205f7b8c724c1ca3d7dc53fd4b47fa8af0bd35dc0a06c76ed7","observation_id":"4f198517-b039-4cdc-aeb3-51b275458aca","resolution":{"observed_at":"2026-08-06T19:30:12.379145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:12.486786Z","title":"Implicit neural representations for variable length human motion generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:12.486786Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:a31b355c5a16abb519fbaf0f9b95bd7c11d2563118c82ec48a0ef1b10abcdde6","observation_id":"93da222b-97bc-40f9-8de7-819c4d909202","resolution":{"observed_at":"2026-08-06T19:30:12.486786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:12.563700Z","title":"Rethinking human motion prediction with symplectic integral","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:12.563700Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:8992f0798e1af8d24ebd69a35af69383f60a3c6d4adb350f407336d791052047","observation_id":"169925e9-ac56-4f92-8a82-3c20c79a5bd3","resolution":{"observed_at":"2026-08-06T19:30:12.563700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:12.661923Z","title":"Humanmac: Masked motion completion for human motion prediction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:12.661923Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:e2f8490b8f0200928439ada44f51c2c023283f70ed9e3c0781c0cd38fef039a7","observation_id":"1a10ed3a-8958-4adc-ad9b-5c2400c0dc74","resolution":{"observed_at":"2026-08-06T19:30:12.661923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:12.740596Z","title":"Taming diffusion probabilis- tic models for character control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:12.740596Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:ff2ec288671c7d1d8af3582aa36cb720d0dd129b75fb190fa57d7b5bd05962a6","observation_id":"2e3ded2d-075d-4565-a728-f3708104c643","resolution":{"observed_at":"2026-08-06T19:30:12.740596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:12.817667Z","title":"Executing your commands via motion diffusion in latent space","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:12.817667Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:950ea34cdda84d8814f467ff533a33cd39c0a7b7f07d3eb1a65646e7a6e65bf7","observation_id":"ef221a25-daea-4596-ac01-38331c16349e","resolution":{"observed_at":"2026-08-06T19:30:12.817667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:12.890550Z","title":"Cmu graphics lab motion capture database","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:12.890550Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:909f6280f18ea7c6a36506e03fe68ad8ebea57f233dd7628f906fa515182c8a6","observation_id":"a3fe5a07-dc27-4f56-b311-590f1be50c3f","resolution":{"observed_at":"2026-08-06T19:30:12.890550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:12.978291Z","title":"Flexible motion in- betweening with diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:12.978291Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:1f8ab46eafbc94b38005c0d24da0b55e473125ee212c99c3d6a9ac9075b1d6cf","observation_id":"e956a239-328b-4572-b55f-76219a36d080","resolution":{"observed_at":"2026-08-06T19:30:12.978291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:13.048714Z","title":"Mofusion: A frame- work for denoising-diffusion-based motion synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:13.048714Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:a54c78ab8d7dc94b77f26c68fd12c26d098f4769704d441490dd9eec5ebaded6","observation_id":"7e59bf34-ec2a-425a-9c65-2d0735faaad6","resolution":{"observed_at":"2026-08-06T19:30:13.048714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:13.121125Z","title":"Motionlcm: Real-time controllable motion generation via latent consistency model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:13.121125Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:542811ad4450e343e4128543fe8a6863ac74baf8a4acf1019a9895f58fffbd0a","observation_id":"2e2555b7-5aac-4133-8ed6-301fec06caba","resolution":{"observed_at":"2026-08-06T19:30:13.121125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:13.203426Z","title":"Generative adver- sarial graph convolutional networks for human action synthesis","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:13.203426Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:7f4c321f8ec6737b384f4098e0371c78e8a61c81e50c565b8e09058624665582","observation_id":"3698a795-658c-4e01-97ae-922a02a68f1a","resolution":{"observed_at":"2026-08-06T19:30:13.203426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:13.275423Z","title":"Pos- escript: 3d human poses from natural language","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:13.275423Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:dc13cefcdde42a49b0846558f11dca0724246f24af0a65913eeffc48fbe71800","observation_id":"a826ff51-3fef-4fb6-89b5-f8aadd08089c","resolution":{"observed_at":"2026-08-06T19:30:13.275423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:13.375648Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:13.375648Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:e034f3447673d90fe4f09f1c375654e7623f7448cc20bf198993c235c4d2b11a","observation_id":"9afd8ee1-6f40-47d5-8341-c598fe90bc2b","resolution":{"observed_at":"2026-08-06T19:30:13.375648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:13.531848Z","title":"Wandr: Intention-guided human motion generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:13.531848Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:fecdb0b90ee79e346f7a0f5a3712f7459c071dc10c80d59baedd406ba2be03c5","observation_id":"500007bf-c87e-4a2c-a55d-59f6ab6c8d77","resolution":{"observed_at":"2026-08-06T19:30:13.531848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:13.707587Z","title":"Investigating the use of recurrent motion modelling for speech gesture generation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:13.707587Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:4bb700833eae5305795502471542ed27378118ca41d87ccf81f34303565e9d78","observation_id":"ee1a48b6-3c18-48ae-afa5-f46068ac9c6a","resolution":{"observed_at":"2026-08-06T19:30:13.707587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:13.858430Z","title":"Recurrent network models for human dynamics","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:13.858430Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:37f86d550da0471ecd3d7f2ec2155e58b45dd3d98260f9e05d3ed103be877ecb","observation_id":"36f07d16-df24-4a3d-8be7-265e9a57b464","resolution":{"observed_at":"2026-08-06T19:30:13.858430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:14.019841Z","title":"Decompose more and aggregate better: Two closer looks at frequency representation learning for human motion prediction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:14.019841Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:fba25dbd6f24f2577d6b2350b34bf185dc3447ac10db0c26788633ca2264a352","observation_id":"1777fab2-2645-4207-89c9-30f00cf6b332","resolution":{"observed_at":"2026-08-06T19:30:14.019841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:14.122530Z","title":"Anytop: Character animation diffusion with any topology","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:14.122530Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:02dea1eb5aeb7ac00974c902b6c49d85384375c3e569d63a8936189aa9b43e33","observation_id":"d3e7e75f-313c-4aad-b285-9d3c622a1a57","resolution":{"observed_at":"2026-08-06T19:30:14.122530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:14.289792Z","title":"Synthesis of compositional animations from textual descriptions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:14.289792Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:44d7d29513641fa9894a0d7ac68636554e25be4b060a929313c00659e19ebfe0","observation_id":"6297b8f3-a697-4121-ae10-ff217d4fe989","resolution":{"observed_at":"2026-08-06T19:30:14.289792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:14.449669Z","title":"Imos: Intent- driven full-body motion synthesis for human-object interactions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:14.449669Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:ed8d0db3cee5e1df51df67b5aded388fb2c7223725d7746c1a45bd53df9acd2c","observation_id":"ec21c4de-c565-45d2-8a57-ed4678552b0e","resolution":{"observed_at":"2026-08-06T19:30:14.449669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:14.628872Z","title":"Generative adversarial nets","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:14.628872Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:6033be12e6272e185f585d9b6f30e711051df9b395dcf089f241dde3b4a55781","observation_id":"3aef3a25-4d54-4e3f-b999-7fad4a2ec308","resolution":{"observed_at":"2026-08-06T19:30:14.628872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:14.764993Z","title":"Momask: Generative masked modeling of 3d human motions","venue":null,"work_id":null,"year":1900},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:14.764993Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:5685272f679df71ddbd4c962ae2b9e7c05fe769091e7cc462d4fe06221fa9ff4","observation_id":"4c39c3e4-f30e-4e80-bbc2-cfad23dd2b55","resolution":{"observed_at":"2026-08-06T19:30:14.764993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13505","last_updated":"2024-02-24T03:18:17Z","snapshot_observed_at":"2026-07-06T17:19:56.099931Z","submitted_at":"2024-01-24T14:53:13Z","title":"Generative Human Motion Stylization in Latent Space","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13505","snapshot_observed_at":"2026-08-06T19:30:14.904829Z","title":"Generative human motion stylization in latent space","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:14.904829Z"},"links":{"cited_paper":"/paper/2401.13505","citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:76c325ddc5ec0992183a354916ed8c19435c18cbc12e66caa7e6733d59b27d6e","observation_id":"233ed8c7-96ff-4981-8831-7d77969307af","resolution":{"observed_at":"2026-08-06T19:30:14.904829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:14.990783Z","title":"Generating diverse and natural 3d human motions from text","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:14.990783Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:b1e1325871ea0105ce5867b371d7c60cef3e44f18f933bc3af94a3cbcafa4742","observation_id":"a40039c9-1f0e-4ab8-a5a0-2c8fa273a276","resolution":{"observed_at":"2026-08-06T19:30:14.990783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:15.106531Z","title":"Tm2t: Stochastic and tokenized modeling for the re- ciprocal generation of 3d human motions and texts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:15.106531Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:92e376c53d63338f0587e6bf69c8eb172f70f378eba464ac884ad72546c247fe","observation_id":"242831ec-822e-4801-a674-cc77438942c3","resolution":{"observed_at":"2026-08-06T19:30:15.106531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:15.240643Z","title":"Action2motion: Conditioned generation of 3d human motions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:15.240643Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:147143a70876c7f100913c455d4ea9e6456c019fd90b6cc4bf182fc37d84a689","observation_id":"b0f88d42-627d-4808-82d5-dc589746e451","resolution":{"observed_at":"2026-08-06T19:30:15.240643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:15.350134Z","title":"Back to mlp: A simple baseline for human motion prediction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:15.350134Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:c6244bfd182646653017d8726f9ca80c6bf39256bedb9930ccf5dfc43c3a00af","observation_id":"e83c4064-66e1-4b17-a563-03301ce47540","resolution":{"observed_at":"2026-08-06T19:30:15.350134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02358","last_updated":"2025-07-22T13:47:07Z","snapshot_observed_at":"2026-08-06T19:33:43.679654Z","submitted_at":"2025-02-04T14:43:26Z","title":"MotionLab: Unified Human Motion Generation and Editing via the Motion-Condition-Motion Paradigm","version":5},"cited_work":{"arxiv_id":"2502.02358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.02358","snapshot_observed_at":"2026-08-06T19:30:23.780913Z","title":"MotionLab: Unified Human Motion Generation and Editing via the Motion-Condition-Motion Paradigm","venue":"cs.CV","work_id":"4bee3dc6-b075-4224-9573-b90bcde30f3f","year":2025},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:15.521820Z"},"links":{"cited_paper":"/paper/2502.02358","citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:6e9f2d285797cc8a64c6f8541ede5f3bf71f2ef4925f20bb59492354b952e266","observation_id":"1a04f5e0-5aa5-4f04-987a-8da58bb073d2","resolution":{"observed_at":"2026-08-06T19:30:23.786110Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:15.678144Z","title":"Robust motion in-betweening","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:15.678144Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:227f8ebae54810985ee9e08b22a495ff80a9b3ce425408afa9bd099c7c6bc1e1","observation_id":"bb8f8616-4512-4402-acee-d1aca2e082d9","resolution":{"observed_at":"2026-08-06T19:30:15.678144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:15.794393Z","title":"Stochastic scene-aware motion prediction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:15.794393Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:7b0944c7bec5d82d606f1b7b6bbf4db6c5b7ec233102d2b93854e12ac51c23ed","observation_id":"de71f9e7-7c26-473b-a384-9b062b819571","resolution":{"observed_at":"2026-08-06T19:30:15.794393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:15.936647Z","title":"Resolving 3d human pose ambiguities with 3d scene constraints","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:15.936647Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:2cfd76cc0cbcceea104839390703bc23c7ce398d9022dc168e07a8194f79d775","observation_id":"d3fabde1-559a-4d22-be19-ebac96a6a669","resolution":{"observed_at":"2026-08-06T19:30:15.936647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:16.107108Z","title":"Hinton and Ruslan R","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:16.107108Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:dee9769655adfdd46bad629a7f07010f928f5650ca7006baa0e67bf4bd1289f9","observation_id":"c285e2b8-c09c-4e7c-a66d-ffba1bbfb7fc","resolution":{"observed_at":"2026-08-06T19:30:16.107108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:16.215297Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:16.215297Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:96798d55c06337568966ff50e27335fe82422772201b3dfe328b331839551485","observation_id":"a2e7b3c7-16cf-4c27-9061-589b0a85d2bc","resolution":{"observed_at":"2026-08-06T19:30:16.215297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:16.280985Z","title":"Como: Control- lable motion generation through language guided pose code editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:16.280985Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:04b757ba8589fb90a17782bf44e649ff68ae0164ddec7196bd0bab530a78f72b","observation_id":"95024b29-98fd-415f-8dce-9c155fdf405e","resolution":{"observed_at":"2026-08-06T19:30:16.280985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:16.374030Z","title":"Adobe mixamo","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:16.374030Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:ce325a942a5bcd571d86c3e158cd9c281db3cc610fa1fc91bce4d21ce8b138f9","observation_id":"43251515-a763-4302-be57-564743a8208e","resolution":{"observed_at":"2026-08-06T19:30:16.374030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:16.539354Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:16.539354Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:36c9bd5cf481bec9a47b752e94c65bea609ead89ba532735454cd037906929c6","observation_id":"02096f49-ddf3-41ac-b032-b8cce4c18fa6","resolution":{"observed_at":"2026-08-06T19:30:16.539354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:16.611673Z","title":"HGM³: Hierarchical genera- tive masked motion modeling with hard token mining","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:16.611673Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:2e6347d0970baae93a006b5fed1ced310755dd65f3e62066dd70efae74c0f209","observation_id":"3fc64f6e-e6fe-4824-8e3e-c760fd0e0581","resolution":{"observed_at":"2026-08-06T19:30:16.611673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:16.686295Z","title":"A large-scale rgb-d database for arbitrary-view human action recognition","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:16.686295Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:a1251ce78df430fb1fa974b2f6e5f12b4241a5be5b8a1f527e9c8ddd48b2eaef","observation_id":"82b1ac56-05fc-490e-b126-f41165d39a7f","resolution":{"observed_at":"2026-08-06T19:30:16.686295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:16.778689Z","title":"Motiongpt: Human motion as a foreign language","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:16.778689Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:e7f474a69e6365eb089132af37f4ea87802537184f75e6262676866a3336a1ae","observation_id":"05ea9b46-c38c-44c4-a075-6734fdd84c53","resolution":{"observed_at":"2026-08-06T19:30:16.778689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:16.846592Z","title":"Motionchain: Conver- sational motion controllers via multimodal prompts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:16.846592Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:392c7c3e4985a7ab0de761c22069a86844a55a135f027ff28d1820b920601b12","observation_id":"032ba91c-541a-4e89-808d-e2cb0dca7e5a","resolution":{"observed_at":"2026-08-06T19:30:16.846592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:16.965049Z","title":"Local action-guided motion diffusion model for text-to-motion generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:16.965049Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:38207dd410107045110e8700344d2b778e7d2685452c0ac0e0999ca8c0067556","observation_id":"17ebde88-4231-4cc7-8f75-6190ad6869ac","resolution":{"observed_at":"2026-08-06T19:30:16.965049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:17.034534Z","title":"Act as you wish: Fine-grained control of motion diffusion model with hierarchical semantic graphs","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:17.034534Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:b8e7dcf48635d1d2af017b8e57af00f61bc62acc9fbe4fb28348eb8d22a13513","observation_id":"f3b16d89-ab4b-4ba0-a7f3-748059ebb108","resolution":{"observed_at":"2026-08-06T19:30:17.034534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:17.130877Z","title":"Dafnet: Generating diverse actions for furniture interaction by learning conditional pose distribution","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:17.130877Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:cd6c10ad0d2324ba9fe0411268a631f9b2f6b7b603f41980348493ccb90b73dc","observation_id":"a4a2e4b9-786a-4f2c-9203-7a385cd0c197","resolution":{"observed_at":"2026-08-06T19:30:17.130877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:17.246347Z","title":"Physics- informed machine learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:17.246347Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:6997366012cb998b3d7f52ff377a20bc47adcac84e28e1872eaa663cab6f979b","observation_id":"922bfcd4-44b3-4715-b16f-fc7ab0e9e586","resolution":{"observed_at":"2026-08-06T19:30:17.246347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:17.303241Z","title":"Guided motion dif- fusion for controllable human motion synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:17.303241Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:095d123e7c1039b205e8e70bbb303178a0879945d04701cac910ff388d6fcd35","observation_id":"2bdea982-3263-4a82-89f6-661f45f25695","resolution":{"observed_at":"2026-08-06T19:30:17.303241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21837","last_updated":"2025-05-28T00:03:39Z","snapshot_observed_at":"2026-08-07T13:19:32.277181Z","submitted_at":"2025-05-28T00:03:39Z","title":"UniMoGen: Universal Motion Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21837","snapshot_observed_at":"2026-08-06T19:30:17.457436Z","title":"Unimogen: Universal motion generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:17.457436Z"},"links":{"cited_paper":"/paper/2505.21837","citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:4839dbd9d7d66fa044a7a2e9c2fdc45140f3e30cd07a104980e707a362e2cb6e","observation_id":"07d7e516-691a-4e49-959b-d74d72346ea8","resolution":{"observed_at":"2026-08-06T19:30:17.457436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:17.572899Z","title":"Flame: Free-form language-based motion synthesis & editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:17.572899Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:9fbbfe29d1c91edc988d467391e23b8a56b44d898a13ea2a8808f845a6487b43","observation_id":"a68fd7ca-11eb-4947-af2e-1ea5c2fa481e","resolution":{"observed_at":"2026-08-06T19:30:17.572899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:17.662231Z","title":"Body gesture generation for multimodal conversational agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:17.662231Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:e9f54cfa814582369729e8d80339e253806fb7394ff24106ecea952e85beacc5","observation_id":"2f2c7e5d-3023-4467-b87e-15374710c8fc","resolution":{"observed_at":"2026-08-06T19:30:17.662231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-06T19:30:17.758779Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:17.758779Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:a9ed75184573491942ebc1c4db202ac8436a2ebaab2a4850db3288147a636231","observation_id":"23da3c44-5cf1-44f3-8be0-df20613dd8bc","resolution":{"observed_at":"2026-08-06T19:30:17.758779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:17.849911Z","title":"Priority- centric human motion generation in discrete latent space","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:17.849911Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:6f8922e7c2e55d047fdf5d704a386622065184dffc55fed2be59c7f960e17d12","observation_id":"0c8cd63d-80ec-43dd-9d98-27ca1f6c5b5b","resolution":{"observed_at":"2026-08-06T19:30:17.849911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:17.955746Z","title":"Moving fast and slow: Analysis of representations and post-processing in speech-driven automatic gesture generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:17.955746Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:073ad212e536dfffd7885fc4d02619551469537febb310e6f14bcbf513b53558","observation_id":"a6c858b8-7ed6-4f59-9245-b9641bc8dcf0","resolution":{"observed_at":"2026-08-06T19:30:17.955746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:18.014291Z","title":"Nifty: Neural object interaction fields for guided human motion synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:18.014291Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:eb4f520fda2043d154b017659bebaa5c165a495d22b078d32fcd5f6fd7f2860f","observation_id":"1ac18ff8-2cc7-457b-9473-561789117227","resolution":{"observed_at":"2026-08-06T19:30:18.014291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:18.106426Z","title":"Multiact: Long-term 3d human motion generation from multiple action labels","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:18.106426Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:3d64deb082212d6cff0c4cf2125eb5f0036c86adc5e68455ac7f2aca61b09107","observation_id":"1e5f6487-c26c-4831-9598-531c0d58ac51","resolution":{"observed_at":"2026-08-06T19:30:18.106426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:18.167625Z","title":"Convolutional sequence to sequence model for human dynamics","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:18.167625Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:d194a05fe20f8299d20233e4eaea7e9e955938d15cb18792e645f29badd72de5","observation_id":"2dc532a7-f47c-4de9-a44e-0ffd80738cac","resolution":{"observed_at":"2026-08-06T19:30:18.167625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:18.221854Z","title":"Foot-constrained spatial- temporal transformer for keyframe-based complex mo- tion synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:18.221854Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:8bff3fa3d12b423d236ed55f53a915987dcf17ca32b07f587633518d90419c54","observation_id":"117a568b-7d6b-4f5b-a6a7-b9a936549068","resolution":{"observed_at":"2026-08-06T19:30:18.221854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:18.265605Z","title":"Finedance: A fine-grained choreography dataset for 3d full body dance generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:18.265605Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:563a96b76bada36e54da89e0e59d3f0ad050a208715590c427d751652f441c9d","observation_id":"cd6fc777-ec57-453a-a4bf-017147c3b54a","resolution":{"observed_at":"2026-08-06T19:30:18.265605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:18.306363Z","title":"Ai choreographer: Music conditioned 3d dance generation with aist++","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:18.306363Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:4dbddf275eb73f0509de6247e08659016737e004aff3fefa57d8aff948b80f71","observation_id":"603b52c8-00fc-4ba7-863f-35797d9f2f91","resolution":{"observed_at":"2026-08-06T19:30:18.306363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:18.382736Z","title":"Aamdm: accelerated auto- regressive motion diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:18.382736Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:1a7fad510e20f891ce4d27c30e934398436c53127dd7690b112b71e3747e0173","observation_id":"a80c6296-8ce3-4113-9491-ded9e8f1f1b7","resolution":{"observed_at":"2026-08-06T19:30:18.382736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:18.440282Z","title":"Controlling character motions without observ- able driving source","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:18.440282Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:863627131839210872c809a424b562292ff04c254af53d05682d27b73ca83963","observation_id":"155a4a0b-1cae-45ff-a735-9d9b4f7a5046","resolution":{"observed_at":"2026-08-06T19:30:18.440282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09901","last_updated":"2025-03-17T18:18:23Z","snapshot_observed_at":"2026-08-04T11:31:58.073444Z","submitted_at":"2024-12-13T06:40:26Z","title":"MulSMo: Multimodal Stylized Motion Generation by Bidirectional Control Flow","version":2},"cited_work":{"arxiv_id":"2412.09901","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.09901","snapshot_observed_at":"2026-08-06T19:30:23.723371Z","title":"MulSMo: Multimodal Stylized Motion Generation by Bidirectional Control Flow","venue":"cs.CV","work_id":"9d24a1e3-c7f7-4be4-85ad-52dabed08134","year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:18.499143Z"},"links":{"cited_paper":"/paper/2412.09901","citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:8d09dfa93e275a065396a4ee2279e6abc95cf02fbc751960ac3bb78ddd3317ff","observation_id":"31a82e56-7ff0-4337-a272-4c846b13912e","resolution":{"observed_at":"2026-08-06T19:30:23.730568Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07093","last_updated":"2025-03-08T06:09:23Z","snapshot_observed_at":"2026-07-06T19:30:34.984716Z","submitted_at":"2024-10-09T17:33:03Z","title":"LaMP: Language-Motion Pretraining for Motion Generation, Retrieval, and Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07093","snapshot_observed_at":"2026-08-06T19:30:18.552722Z","title":"Lamp: Language- motion pretraining for motion generation, retrieval, and captioning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:18.552722Z"},"links":{"cited_paper":"/paper/2410.07093","citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:ce4ffdb9fd888d61f5566d98d40a27128bdab651d48c7b1590ec69d665b266a3","observation_id":"5211cf0d-18b2-4f81-8496-9ed4afd8eec7","resolution":{"observed_at":"2026-08-06T19:30:18.552722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:18.601791Z","title":"Omg: Towards open-vocabulary motion generation via mixture of controllers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:18.601791Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:6a8158929129294d594ea341f8283ab5bd15335ec7f1f9585bdcaa624f16a80d","observation_id":"20c02f46-4428-4f62-8779-0cfe10a94a91","resolution":{"observed_at":"2026-08-06T19:30:18.601791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:18.647322Z","title":"Hybridcap: Inertia-aid monocular capture of challenging human motions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:18.647322Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:07e711dfc092c8d97aa593ed23822e70646014097b7fdc25f150a2681beb285e","observation_id":"37161393-af86-4277-990f-6bc4326b7c60","resolution":{"observed_at":"2026-08-06T19:30:18.647322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:18.688723Z","title":"Intergen: Diffusion-based multi-human motion generation under complex interactions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:18.688723Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:449586ac61baca5aa0beaab546032ced26330a78d106c8c8ec1247ba7a937bd4","observation_id":"7886b26f-f4fb-4898-8f6b-af8e48fc6f72","resolution":{"observed_at":"2026-08-06T19:30:18.688723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:18.739214Z","title":"Motion- x: A large-scale 3d expressive whole-body human mo- tion dataset","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:18.739214Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:47da8a81b297c6bc92c4655b91d00681478dbc12a514e3218963c6e19590ba17","observation_id":"95445dfb-33f4-4562-836e-0ebbe3702577","resolution":{"observed_at":"2026-08-06T19:30:18.739214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:18.791075Z","title":"Being comes from not-being: Open-vocabulary text-to-motion generation with wordless training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:18.791075Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:2785981bf958e7b340f2aa337d6d1700c06baa31e2fd088432dca1359f14d33d","observation_id":"789f4144-8012-42d8-8483-27444554a71a","resolution":{"observed_at":"2026-08-06T19:30:18.791075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17335","last_updated":"2025-05-26T15:27:18Z","snapshot_observed_at":"2026-07-06T19:57:14.289258Z","submitted_at":"2024-11-26T11:28:01Z","title":"VersatileMotion: A Unified Framework for Motion Synthesis and Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17335","snapshot_observed_at":"2026-08-06T19:30:18.861133Z","title":"Motionllama: A unified framework for motion synthesis and compre- hension","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:18.861133Z"},"links":{"cited_paper":"/paper/2411.17335","citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:6780e8575c74cac91789f5584867f99af5eef387ba8425951ff98f1551b48c7a","observation_id":"5400aeaf-0e9c-4c7a-bb32-16220c6e35b0","resolution":{"observed_at":"2026-08-06T19:30:18.861133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:18.928355Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:18.928355Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:fe4f23836ffde0f6fa449d7bb8d820ad8f08b2f9a51e07c479467ba8cd25d9b8","observation_id":"0f938611-9e89-405d-bc98-4d586404dac4","resolution":{"observed_at":"2026-08-06T19:30:18.928355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:18.988933Z","title":"Beat: A large-scale semantic and emotional multi-modal dataset for conversational gestures synthesis","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:18.988933Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:9d765ab6bfe2853d53054dfe49034e2cd15e6097305675ea6a2c41dc51d05847","observation_id":"af0e1301-0394-401c-8026-ff116434872c","resolution":{"observed_at":"2026-08-06T19:30:18.988933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:19.037872Z","title":"Programmable motion generation for open-set motion control tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:19.037872Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:1ef74e79596de9a15284089d246acb459a27fd390ff90ab8101c1822f25228c5","observation_id":"1f1a5285-1f9a-499f-84b2-c5c4a4a7f0b9","resolution":{"observed_at":"2026-08-06T19:30:19.037872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:19.085925Z","title":"Plan, posture and go: Towards open-vocabulary text-to-motion generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:19.085925Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:dbe0ffbe2be7ac0c3662ec56968c11df9a72769eebba1ba220cc6f8b5b009256","observation_id":"6aea1374-2753-4d8b-838c-7b15c9d8540c","resolution":{"observed_at":"2026-08-06T19:30:19.085925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:19.123053Z","title":"Ntu rgb+ d 120: A large-scale benchmark for 3d human activity under- standing","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:19.123053Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:3883becc72f13a010cca42d61875e3fa8deb791b1c2a5b1441d6b7054edc94fd","observation_id":"b03ea086-51b6-4dea-832d-557a320bf655","resolution":{"observed_at":"2026-08-06T19:30:19.123053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:19.166297Z","title":"Learning hierarchical cross-modal association for co-speech gesture generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:19.166297Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:569654d969b1a2fb661b4e8e6ac94edadc47d7475b08ffae3fd94af974cec56d","observation_id":"2b4801ac-d89a-4294-82ab-1ee5e44f0b2f","resolution":{"observed_at":"2026-08-06T19:30:19.166297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:19.208062Z","title":"Smpl: a skinned multi-person linear model","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:19.208062Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:2ba0850c180d64f53a0099f1c8bb803d7b06c69453d88d36bd2fb038e3249ba0","observation_id":"31f1496a-8c82-4955-aa6c-f0fd3a545ee9","resolution":{"observed_at":"2026-08-06T19:30:19.208062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:19.265456Z","title":"Posegpt: Quantization-based 3d human motion generation and forecasting","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:19.265456Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:aba2a72b3bc7a2ca0ed810063a2f7aac19d8440e421008b118b23faa45ed2261","observation_id":"13192526-d9a8-41ab-bdc4-3ffb42568271","resolution":{"observed_at":"2026-08-06T19:30:19.265456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16273","last_updated":"2024-11-02T04:39:28Z","snapshot_observed_at":"2026-07-06T18:19:52.121906Z","submitted_at":"2024-05-25T15:21:59Z","title":"M$^3$GPT: An Advanced Multimodal, Multitask Framework for Motion Comprehension and Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16273","snapshot_observed_at":"2026-08-06T19:30:19.355699Z","title":"M 3 gpt: An advanced multimodal, multitask framework for motion comprehension and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:19.355699Z"},"links":{"cited_paper":"/paper/2405.16273","citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:7a761972ea249b206bcaf325c0149b52ed9797dd7f31f127ea9b8f904cad4b3d","observation_id":"72a1979f-ff13-4c0b-93c6-4ae3a0284d3f","resolution":{"observed_at":"2026-08-06T19:30:19.355699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:19.392924Z","title":"3d human motion prediction: A survey","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:19.392924Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:82ebafbdb0aa96a0376986d4bfa3a1c3abb4e8894eb7de6614b1a764963e493b","observation_id":"0f15ecf0-7268-4ea5-8968-222f7e4ab425","resolution":{"observed_at":"2026-08-06T19:30:19.392924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:19.482297Z","title":"Amass: Archive of motion capture as surface shapes","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:19.482297Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:8df55a281771d1ee1a1527b4542055b0855dfede15c2aa7650fd2f0903165f41","observation_id":"236f81af-ec6d-4f9d-b648-04f28aec1dd7","resolution":{"observed_at":"2026-08-06T19:30:19.482297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:19.493928Z","title":"Generation of complex 3d human motion by temporal and spatial composition of diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:19.493928Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:d730c807653afe1ee98afce5763da448fb0a12cae0e8a7cc4bf5c92338ad7de3","observation_id":"57106664-014e-4b8e-8c0c-74d70ac508a1","resolution":{"observed_at":"2026-08-06T19:30:19.493928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:19.531219Z","title":"Human motion prediction using recurrent neural net- works","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:19.531219Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:cd205cd04f112f50604942fbb0c07e55fe35e59e201c5de1af9fc58f47cd9220","observation_id":"19e47c54-0031-44b6-9097-6df9d5c51a99","resolution":{"observed_at":"2026-08-06T19:30:19.531219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:19.629676Z","title":"Real- time style modelling of human locomotion via feature- wise transformations and local motion phases","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:19.629676Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:733248b10ee7bfc6e1f7e5347cfa668b0944210752fc1331f698f2d989a33cf9","observation_id":"8f9e4a92-94d9-4c01-a0ea-5e8f8b1ffdc3","resolution":{"observed_at":"2026-08-06T19:30:19.629676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:30:19.706422Z","title":"Monocular 3d human pose estimation in the wild using improved cnn supervision","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:19.706422Z"},"links":{"citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:849eb69eb0e83b93a30ea51f52a1621fe732d4f0b594943a3d6a6f61eef9ba56","observation_id":"10b32e03-b45b-4295-b307-3a56cf759dd1","resolution":{"observed_at":"2026-08-06T19:30:19.706422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19377","last_updated":"2025-05-30T19:54:43Z","snapshot_observed_at":"2026-08-08T06:06:45.867296Z","submitted_at":"2025-05-26T00:36:00Z","title":"Absolute Coordinates Make Motion Generation Easy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19377","snapshot_observed_at":"2026-08-06T19:30:19.887163Z","title":"Absolute coordinates make motion generation easy","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:19.887163Z"},"links":{"cited_paper":"/paper/2505.19377","citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:a9fbfecbdbd55b82b3564ddeedce10e875278f8a03db3250e1164b10dbaa2d77","observation_id":"22546892-d892-4a98-8eeb-cac79ed2e578","resolution":{"observed_at":"2026-08-06T19:30:19.887163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16575","last_updated":"2025-07-08T20:15:01Z","snapshot_observed_at":"2026-07-06T19:56:39.115630Z","submitted_at":"2024-11-25T16:59:42Z","title":"Rethinking Diffusion for Text-Driven Human Motion Generation: Redundant Representations, Evaluation, and Masked Autoregression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16575","snapshot_observed_at":"2026-08-06T19:30:20.017675Z","title":"Rethinking diffusion for text-driven human motion generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:20.017675Z"},"links":{"cited_paper":"/paper/2411.16575","citing_paper":"/paper/2507.05419"},"observation_digest":"sha256:9442558c52d2c59bf3d7cdf22fcf532f034d4e084be0d2f6c2a0454ef3eb55cf","observation_id":"a52edd66-8f6e-44f0-958c-93a86e011122","resolution":{"observed_at":"2026-08-06T19:30:20.017675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.05419","last_updated":"2025-07-07T19:04:56Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T19:32:58.763798Z","submitted_at":"2025-07-07T19:04:56Z","title":"Motion Generation: A Survey of Generative Approaches and Benchmarks"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":98,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":193},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 193 outbound references and 5 inbound Pith citation observations for arXiv:2507.05419."}