{"as_of":"2026-08-22T06:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:472450297e03cce5433c08f8df9f490f68329511767e0b91436c395c44ce2621","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T08:51:14.809528Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.29906/citation-record","integrity":"/paper/2605.29906/integrity","json":"/paper/2605.29906/citation-record.json","paper":"/paper/2605.29906"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Proto successor measure: Representing the behavior space of an RL agent","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:627abbbc86e96bb7cce6c661eda125fea9e2f14391b7bd3ee9167ba41266c547","observation_id":"d4c7c361-2297-4881-b5d0-e9ce388f2bf5","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Language2pose: Natural language grounded pose forecasting","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:f5af008dc47273a934c7bc6da6da5101fa9d2179be3f89c1dca33b26dba7756f","observation_id":"8b37bf88-c354-4047-ad81-83033470b2da","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Albergo, Nicholas M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:cd22039a4f4e9fd69c49a8d90b23324afec95ee3903ea8a01cd8b84066bdf45e","observation_id":"4fd2424a-de61-420b-84f0-6e359a0087e9","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Hunt, Tom Schaul, Hado van Hasselt, and David Silver","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:ce25bedb1ef6eebf8abc8fcee6333026a519a1116a229845076ff6cd6933ed20","observation_id":"a0b1fd44-eb27-4125-b283-847cfd22b2ab","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.07123","last_updated":"2021-01-18T15:33:26Z","snapshot_observed_at":"2026-08-20T11:12:21.427165Z","submitted_at":"2021-01-18T15:33:26Z","title":"Learning Successor States and Goal-Dependent Values: A Mathematical Viewpoint","version":1},"cited_work":{"arxiv_id":"2101.07123","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2101.07123","snapshot_observed_at":"2026-07-01T06:55:29.516438Z","title":"arXiv preprint arXiv:2101.07123 , year=","venue":null,"work_id":"39690949-732b-4e57-ad99-9cb8cedf5239","year":2021},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"cited_paper":"/paper/2101.07123","citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:023d429c2099f64d85b885b3ff7c65863ae508c76677173c75c465a4a6f97099","observation_id":"2329491f-01f8-4d0e-8440-266a531305c8","resolution":{"observed_at":"2026-06-29T08:53:15.706839Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:bba7d30f0ff4282a7b36449c1ff79daa508737b5fafe364507a6af4832760688","observation_id":"2f0141d7-701d-4662-8c67-7717ee0b45d2","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Executing your commands via motion diffusion in latent space","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:bc80181bfda0e2bf94aacd6f5861c76ec7eb22addedab4ab954774ae84c6a764","observation_id":"611169fb-e77e-478b-9dbf-198ca6b3a1ff","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Improving generalization for temporal difference learning: The successor repre- sentation.Neural Computation, 5(4):613–624, 1993","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:459556549b4014acaae259aa6913584195d4fd0fd85897cc0a7cfb687ba3ef22","observation_id":"9ac5b6f1-f015-4a06-a13e-6aa576c800b7","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Go to zero: Towards zero-shot motion generation with million-scale data","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:4ca3bb0d6e5ac3d6f90de83ea3f9e9d963449f11626a2f17f3fba43329d7f0b8","observation_id":"81700a59-671e-4409-8776-abbd1a5ea818","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Syn- thesis of compositional animations from textual descriptions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:00e7b88d18ed0427d02aaf932646dc4a2f4f1f29bef82af4594668dd772963a5","observation_id":"c9b60be9-1d6d-4cb8-ba78-970e9b61992e","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Hu- manML3D: A large and diverse 3d human motion-language dataset","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:90bc537cf113099e8d5d475629b1120669b60bdfc49ae8523b4adb2eba824ed8","observation_id":"86a045ed-17ae-4adc-9f2e-3b9dc66c3c92","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Tm2t: Stochastic and tokenized modeling for the reciprocal generation of 3d human motions and texts","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:1a19ee70f22d830ee006a47dc411204c8ba677f0d13d69f0c83c13c2df4a3e10","observation_id":"fedba014-27b2-43bc-9601-8a2b5ea482ce","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Momask: Generative masked modeling of 3d human motions","venue":null,"work_id":null,"year":1900},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:4afdfa448145d0fafe7c6e53591eda29049c8efe4a29bd0ad91bccbb60112506","observation_id":"1eb36bd5-c8f4-4e95-8b14-a6f0d66a93ba","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Kingma and Max Welling","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:3568474ea5d7bc9ad6afd683b00d39b51788c75d93f0db2bc10d30865d2f7225","observation_id":"eeabe171-0010-409b-8e88-c9121a585b6b","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"BFM-zero: A promptable behavioral foundation model for humanoid control using unsupervised reinforcement learning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:c3eaaff7114269da8b5d3784f23cc4d442b29e9acb2293598c6d304603715f44","observation_id":"a3c0b16b-79ce-40c7-9276-85cf2abfd5a2","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17335","last_updated":"2025-05-26T15:27:18Z","snapshot_observed_at":"2026-08-18T04:06:00.123370Z","submitted_at":"2024-11-26T11:28:01Z","title":"VersatileMotion: A Unified Framework for Motion Synthesis and Comprehension","version":2},"cited_work":{"arxiv_id":"2411.17335","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.17335","snapshot_observed_at":"2026-07-04T06:19:37.765442Z","title":"arXiv preprint arXiv:2411.17335 (2024) 11","venue":null,"work_id":"f6a32874-b71c-4af8-9037-0e5b225a3289","year":2024},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"cited_paper":"/paper/2411.17335","citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:104ac362c882524539afb34c0e8a49fa477117c51a8ed63a7b3c386a2e58750b","observation_id":"e9adb9cb-4daf-41a2-a3c9-33792a5ca88f","resolution":{"observed_at":"2026-06-29T08:53:15.719398Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-16T02:30:42.660030Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":"2210.02747","doi":"10.1038/s41467-024-47656-z","metadata_source":"pith","pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flow Matching for Generative Modeling","venue":"cs.LG","work_id":"6edb71c4-5d64-40af-a394-9757ea051a36","year":2022},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:d5676edb4307315820f86b6c19d1139ec179fb4f3038078d9384ceb1b049bfe6","observation_id":"e1d50daa-5364-4e29-8202-8c9d68c2ee16","resolution":{"observed_at":"2026-06-29T08:53:15.713273Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Flow straight and fast: Learning to generate and transfer data with rectified flow","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:089a5a3668161c963e68ab400afa96659293f90f2857907095f04ec6d5bdd57f","observation_id":"c26f0eeb-b8ca-4d61-92a8-03cd457a56f8","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Perpetual humanoid control for real-time simulated avatars","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:4e0c616e6a1659de1e3aac6a56f3badeb4e357b6a1481a7e2000e230cc8b213e","observation_id":"003e2502-00a8-473c-b0f6-3b33dfc6b476","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Hierarchical motion generation with diffusion transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:f9babe5ce1203d6430d149e54c975aa1fcd57091137ab81f003daa51f60d2851","observation_id":"2bb20b0c-2755-4bcb-ab78-5916b4bbdfe2","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Troje, Gerard Pons-Moll, and Michael J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:bf00dab68cc07ca1aff25d893b576913dfa582d568a25d680e702a033462d5d5","observation_id":"f01486fa-4b35-4e99-8ad2-66dac7036016","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04561","last_updated":"2023-12-07T18:59:41Z","snapshot_observed_at":"2026-08-16T14:36:43.575470Z","submitted_at":"2023-12-07T18:59:41Z","title":"GenDeF: Learning Generative Deformation Field for Video Generation","version":1},"cited_work":{"arxiv_id":"2312.04561","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.04561","snapshot_observed_at":"2026-06-29T08:53:15.720927Z","title":"MoMask: Hierarchi- cal masked 3d human motion generation.arXiv preprint arXiv:2312.04561, 2023","venue":null,"work_id":"bc24a0d6-b5f2-443f-9870-d35ad8263fe5","year":2023},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"cited_paper":"/paper/2312.04561","citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:1f627be6437671e90c774474dcbc13a475db6533de35118caff22ddf415d8223","observation_id":"80e1aea0-ce49-4c1b-b82c-32c18a119631","resolution":{"observed_at":"2026-06-29T08:53:15.722701Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:0b86d12e039984d1ff0d4e06bcc6512e0f3ba6afa795a23cb5930287d0bd6740","observation_id":"f015d779-3b7b-446f-a1eb-006ca65a01f4","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"AMP: Adversarial motion priors for stylized physics-based character control.ACM Transactions on Graphics, 40 (4):144:1–144:20, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:cd03a4f81e5990af255cf75236f1d27ecd8b0a3a0a5ed36172c6f8600c851820","observation_id":"02fc8b74-b9de-4b1e-95e6-fbbca6535af4","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"ASE: Large-scale reusable adversarial skill embeddings for physically simulated characters.ACM Transactions on Graphics, 41(4):94:1–94:17, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:53397eb3c93229de150656f8fef1626a092d19cd74220e6822a58292f4d0bdc7","observation_id":"d37f1363-c132-4abd-a5c4-55262760fa07","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Black, and Gül Varol","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:e26235fa3644989964284da1c373319b59eec607507281aa2176535156d63754","observation_id":"8edcc417-2630-4b94-9697-7d7a6c26fe4e","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Black, and Gül Varol","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:bf0e4b67646ddeab3f2f53d43b765b7df93755c3360d820f0762634cf8427897","observation_id":"c9b6a31e-adcc-461a-bd9e-36f4223324f5","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2016.0028","doi":"10.1089/big.2016.0028","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Big Data 4(4), 236–252 (Dec 2016).https://doi.org/10.1089/big.2016.0028,http:// dx.doi.org/10.1089/big.2016.00284","venue":"Big Data","work_id":"69a6c049-487b-430a-8100-0c2770d8ace8","year":2024},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:2685797ae1a99d822494cad63c33e08190f2f1c82dd1c5556f5418df660e7214","observation_id":"7da14b6c-0f83-4478-abd6-a45f5a9ea850","resolution":{"observed_at":"2026-06-29T08:53:15.339099Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:9b3721310481c89d053887ee39a674f3c28352902df9d96b51106ff6a80e51b1","observation_id":"0e1038ec-c7ae-44d7-8b9b-3cfc0f0a4de8","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:b04443e19bdfbe84c9baae619d068def40351b72953ed14242014769edce80ad","observation_id":"f00cb3e9-8504-45cd-831e-1ebbcfa500b0","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.15546","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:16:42.486912Z","title":"arXiv preprint arXiv:2603.15546 , year=","venue":null,"work_id":"f2e9bc1c-11f1-4adb-a4a0-a638de0fbcff","year":2026},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:707ff3de1407dadabd1ac6e1ea024f6fb4aa0514abd92ac21f7cdaee24faf5e9","observation_id":"8040e4d9-3209-4456-8480-e9260efba135","resolution":{"observed_at":"2026-06-29T08:53:15.710838Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Stochastic backpropagation and approximate inference in deep generative models","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:1b57c36cb8f52b5a3603e108a4509841f70a2b69bbeacb0d6d10a1043b157098","observation_id":"6e743144-0c7c-495c-9a61-fe92dd3693f9","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"RL zero: Zero-shot language to behaviors without any supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:9ecb1e63b477ebe8a81a0ec25450747d5f02e323d2295af621dc8979b5683226","observation_id":"9b6a15ee-3024-4664-83b5-915396778327","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:7c2d466c8b7c62e81df36bbd00dbb4e4edccee7778e7655fe3af51f088085132","observation_id":"3f716e78-69d6-4431-9fbb-bbe64fbcd330","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"CALM: Conditional adversarial latent models for directable virtual characters","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:d52eef72b8f5784ec894477e764c5112de8f83090f1b73b12882b35eb9fa664b","observation_id":"bd7a0bf7-2e14-4575-a857-ad11d75b5e0d","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Bermano, and Daniel Cohen-Or","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:6ace3fcdd31d3fbf67af625b082f9ce69fbeb4b5b7bb6a7f8c614a62f588f3aa","observation_id":"3916df0f-b817-4eca-b019-3fef375dbf76","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:14f9d8fe58d47151cfc68004101d3e71a1c7cec284c40216de716fcaf94c5781","observation_id":"89662ca6-ec7c-44a8-96dd-fad0e2e89519","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Zero-shot whole-body humanoid control via behavioral foundation models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:6980add3cf0999b359fccd5a53871efbaf1f0b7018270e057eb97e465cbf250c","observation_id":"4568a341-f67d-4bf2-9a5f-4aad6deb6b14","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Learning one representation to optimize all rewards","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:37da5cdfe3ae6f0392cf0a05b4f8576eb3e85763f96baaaf985cdcc99fe8d739","observation_id":"dce0e029-c75b-46fe-a7ba-fc845742751b","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Does zero-shot reinforcement learning exist? InThe Eleventh International Conference on Learning Representations, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:0cc26001da7170379a7d6486ff98057f96248ec818cdec6fce85bae56fcb254e","observation_id":"415e2c6b-60a1-4394-a529-cba808728a92","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.23464","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T19:35:32.961126Z","title":"arXiv preprint arXiv:2512.23464 , year=","venue":null,"work_id":"a544862c-82d6-4273-b97a-c7e48025687e","year":2025},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:9487eee5a39d93f089521ce4d02f07c9a5881c7e9671e739eb8043feb9f4c9ff","observation_id":"d27275c6-220e-49f3-8a12-fff75fc8c83a","resolution":{"observed_at":"2026-06-29T08:53:15.716544Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"PhysDiff: Physics-guided human motion diffusion model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:b55a0069a1e254b80e013c204e79425aa43b4b42624cd155c7aa9072139da2fe","observation_id":"5feb1113-5f3a-491e-a4b8-ee19c641aa2d","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Generating human motion from textual descriptions with discrete representations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:3ddede176e9974b4e26b13f7fbba57aa39a2e1419a99fc7de72330bd7a0d3b38","observation_id":"8ada9fc8-196d-4cfd-a100-10448011e0c3","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"MotionDiffuse: Text-driven human motion generation with diffusion model","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:ddc16f2ab3534ac7760c3b585aa44084658da2db16e54ec80634645a63867e03","observation_id":"7d7186b8-8869-45f7-b205-24fed0e0d72f","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Remodiffuse: Retrieval-augmented motion diffusion model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:727ae4ca25fed8954cb6428586e39ee9e1d1925abc258df1c8b948336338dbf9","observation_id":"80166a8d-27dd-4086-a87e-538b4a10bf42","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:51:14.809528Z","title":"Stage 2: Text-to-latent generator .A pretrained FB backbone is adapted to predict latent mo- tion sequences conditioned on text","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:14.809528Z"},"links":{"citing_paper":"/paper/2605.29906"},"observation_digest":"sha256:0c281621473be0cb0a9407122eefde4e1387c4c9fa6a16a18ad7244c23153a4a","observation_id":"7feb71d4-5ede-43c1-bc41-9e8276c407c9","resolution":{"observed_at":"2026-06-29T08:51:14.809528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.29906","last_updated":"2026-06-11T14:09:45Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T09:46:25.828669Z","submitted_at":"2026-05-28T13:24:30Z","title":"Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":39,"verified_exact":6,"verified_fuzzy":0},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2605.29906."}