{"as_of":"2026-08-07T11:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6671b103b678fdb9fa9b046719aadb079d5e547a1a1e7328223c6a715a020734","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T08:28:42.524111Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T07:48:24.383009Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T13:38:19.027249Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"cited_work":{"arxiv_id":"2604.23264","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.23264","snapshot_observed_at":"2026-07-03T13:38:19.027249Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","venue":"cs.CV","work_id":"4274ac79-9d40-42aa-914e-74b8f45de517","year":2026},"citing_paper":{"arxiv_id":"2606.11656","last_updated":"2026-06-25T06:35:40Z","snapshot_observed_at":"2026-08-07T05:20:49.094524Z","submitted_at":"2026-06-10T04:38:35Z","title":"MoGeFlow: Flowing Through Motion Codebook Geometry for Text-to-Motion Generation","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-27T07:48:24.383009Z"},"links":{"cited_paper":"/paper/2604.23264","citing_paper":"/paper/2606.11656"},"observation_digest":"sha256:19a35bcf16dc9a6b2fd5054a023e50ba7649cc847f13423cae7578a57a31b516","observation_id":"07bdb330-3a8a-4017-a873-410c4b85aefd","resolution":{"observed_at":"2026-07-03T13:38:19.028566Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2604.23264/citation-record","integrity":"/paper/2604.23264/integrity","json":"/paper/2604.23264/citation-record.json","paper":"/paper/2604.23264"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lan- guage2pose: Natural language grounded pose forecasting","venue":null,"work_id":"be7271f9-4966-4e42-8f8f-e595ffc4aff4","year":2019},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:42b84bfe62febd744512ae98eebca264aea92ce4e1ecd332b485bb1de659cd8a","observation_id":"45888225-84ad-44fe-a71c-4b43228a7892","resolution":{"observed_at":"2026-05-26T16:57:40.520005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20340","last_updated":"2024-05-30T17:59:50Z","snapshot_observed_at":"2026-07-06T18:22:57.400982Z","submitted_at":"2024-05-30T17:59:50Z","title":"MotionLLM: Understanding Human Behaviors from Human Motions and Videos","version":1},"cited_work":{"arxiv_id":"2405.20340","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20340","snapshot_observed_at":"2026-07-04T03:39:29.096987Z","title":"Motionllm: Understanding human behaviors from human motions and videos","venue":null,"work_id":"8fefb27e-4d05-4ce7-8de7-944336c1288d","year":2024},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"cited_paper":"/paper/2405.20340","citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:1484e25f1f012e69681700299d6b4588764dbefbd1c967c9c4849c845561359e","observation_id":"5735b75f-2e32-4b48-8fbb-c2bace7baf84","resolution":{"observed_at":"2026-05-11T20:36:10.922429Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07963","last_updated":"2025-04-10T17:59:56Z","snapshot_observed_at":"2026-08-04T06:26:36.498042Z","submitted_at":"2025-04-10T17:59:56Z","title":"PixelFlow: Pixel-Space Generative Models with Flow","version":1},"cited_work":{"arxiv_id":"2504.07963","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.07963","snapshot_observed_at":"2026-07-04T20:50:11.498748Z","title":"arXiv preprint arXiv:2504.07963 (2025)","venue":null,"work_id":"1beb1a44-0887-4a87-93c8-5dca148563bd","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"cited_paper":"/paper/2504.07963","citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:8c93d3becc746d73e1e1f6c9990308bad4b2228a95c94ac4717b9e7cf73ea3f5","observation_id":"1e6846d6-2171-4449-9417-c16cff0a8cdf","resolution":{"observed_at":"2026-05-11T20:36:10.898980Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Executing your commands via motion diffusion in latent space","venue":null,"work_id":"8a0295f3-a97c-4c6f-9024-b362566e5a56","year":2023},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:03d78b86486a5894c3709c3eb8244d3b87ba9ba195bc7c3d75d113e47f14d754","observation_id":"d97be72c-1163-4794-858e-0610f82d6178","resolution":{"observed_at":"2026-05-26T16:57:40.360816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Snap- mogen: Human motion generation from expressive texts","venue":null,"work_id":"b36afc94-7818-4afd-a141-c093823fc22a","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:d77b813163f5e11b6f343100b9d085e1e12cf0005aeb14c2be5c9382f8e0db8d","observation_id":"7ec34b2f-cf55-4a9b-bd7d-6036ecf22500","resolution":{"observed_at":"2026-05-26T16:57:40.356844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01338","last_updated":"2025-04-25T02:39:26Z","snapshot_observed_at":"2026-07-06T21:02:47.555948Z","submitted_at":"2025-04-02T03:55:21Z","title":"FlowMotion: Target-Predictive Conditional Flow Matching for Jitter-Reduced Text-Driven Human Motion Generation","version":3},"cited_work":{"arxiv_id":"2504.01338","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.01338","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flowmotion: Target-predictive flow matching for realistic text-driven hu- man motion generation.arXiv preprint arXiv:2504.01338","venue":null,"work_id":"eec4c6bf-0b37-49e0-9f85-f7bde63196f1","year":null},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"cited_paper":"/paper/2504.01338","citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:d319de0af090533b37073d88f16891691e0c18ac09316fa8d333d9aec58ae553","observation_id":"f8c673c5-3167-4e11-b3fa-d4f5ae65f018","resolution":{"observed_at":"2026-05-11T20:36:10.912040Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mofusion: A framework for denoising-diffusion-based motion synthesis","venue":null,"work_id":"1f105808-4dde-4ea7-833c-1aa2c3554d43","year":2023},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:9de42fae43282416edcf4b06e6ed274d427cbbbb03ef819593c2f1ea4c4fe1a9","observation_id":"16845f20-0ff6-4773-b71a-9928789efc92","resolution":{"observed_at":"2026-05-26T16:57:40.366102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Motionlcm: Real-time controllable motion generation via latent consistency model","venue":null,"work_id":"607354a6-7007-46fb-a7bc-d4f435da0546","year":2024},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:faf82cc6b05dab4a83c407d23f6c25658af2a42bd43fd42c551dd416aafbd0b5","observation_id":"579a868e-b8aa-445c-a2ac-bf82630ba7f2","resolution":{"observed_at":"2026-05-26T16:57:40.372764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wandr: Intention- guided human motion generation","venue":null,"work_id":"d41b9ae8-6246-41d7-8ac4-327cf60f43fa","year":2024},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:b59e38893032236151d3265b8782dbe60dd57da535ba8a4905677565f42a3461","observation_id":"ae08d338-e294-45b5-85a1-05065122045a","resolution":{"observed_at":"2026-05-26T16:57:40.353412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A family of embedded runge-kutta formulae.Journal of computational and applied mathematics, 6(1):19–26","venue":null,"work_id":"0a317fd9-bbf4-4e4d-b187-01df2691a636","year":1980},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:97d9220df2ff64c7f15ecddb443135cb2ee630595c1d4a84c0e30ab27c3a0e2a","observation_id":"2ee1d635-b28e-4ce6-89b5-8219e787969e","resolution":{"observed_at":"2026-05-26T16:57:40.346235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":"e8b38c41-9493-4fb5-b7b7-9623d1841cf1","year":2024},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:5c20369f88314d32ebf8616ece09cbb05ba41c0bf080af845566105f541a9128","observation_id":"bb11a7c3-296c-4fca-85dc-ea3df5e858ab","resolution":{"observed_at":"2026-05-26T16:57:40.342985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ac- tion2motion: Conditioned generation of 3d human motions","venue":null,"work_id":"da8bb05e-99e3-4e22-a847-a4e0101e47ad","year":2021},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:9dd22d8c477b68cbeba0b089f52e111ce1fe5760b44ec4c5a62cdd9b7b78758e","observation_id":"23373ddc-ce5a-497e-883a-0c3ed5184a05","resolution":{"observed_at":"2026-05-26T16:57:40.350007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generating diverse and natural 3d human motions from text","venue":null,"work_id":"5959ccca-fc06-405e-b8a7-71f25ddef6c0","year":2022},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:9228296db677fba982ed9dbb2f4dffa3f21cdea8d69b594beadaca9ed0665c7c","observation_id":"333c7ecf-7b69-47c3-b78b-92cbb9c4baca","resolution":{"observed_at":"2026-05-26T16:57:40.369021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tm2t: Stochastic and tokenized modeling for the reciprocal genera- tion of 3d human motions and texts","venue":null,"work_id":"5b72a7ae-17bf-4485-abd3-0be032767452","year":2022},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:70c50cc3d99e6d97bdb27ddd97ef5ba04dca9f2ff6a04061b5946fcdf3f3643d","observation_id":"864b42a2-b039-49a5-88eb-16920a2d33c5","resolution":{"observed_at":"2026-05-26T16:57:40.398534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Momask: Generative masked modeling of 3d human motions","venue":null,"work_id":"8e35cfaf-11c1-4879-b758-91f49f577037","year":2024},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:e00eb9873ac58a52b5365b7b6cdb9c62a43ed6354188b586ad419e7565b57ee3","observation_id":"ef5a5e90-11d1-42b3-ad43-38b34be0d126","resolution":{"observed_at":"2026-05-26T16:57:40.332684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":"2207.12598","doi":"10.1109/cvpr52733.2024.02494","metadata_source":"pith","pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Classifier-Free Diffusion Guidance","venue":"cs.LG","work_id":"acf2c588-c088-4a6c-938e-150ad7c666d7","year":2022},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:5adcc0b42a8a43e9eff77c6970ccb94f796446f5fe4e1f861f7871110bce2f19","observation_id":"d3b3dd51-6056-4e9b-8b58-6f92a8a7a5be","resolution":{"observed_at":"2026-05-11T20:36:10.916801Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13836","last_updated":"2025-03-18T02:20:11Z","snapshot_observed_at":"2026-07-06T20:54:22.992859Z","submitted_at":"2025-03-18T02:20:11Z","title":"SALAD: Skeleton-aware Latent Diffusion for Text-driven Motion Generation and Editing","version":1},"cited_work":{"arxiv_id":"2503.13836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.13836","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Salad: Skeleton-aware latent diffusion for text-driven motion generation and editing","venue":null,"work_id":"c9b9da4e-bde9-45a2-b36c-eeedf7404b2a","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"cited_paper":"/paper/2503.13836","citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:69bc2eab1692a87884c2a340dc6be2c4c1b4b5b2dacdbd845b53b1417a2bb3ad","observation_id":"25c6f6f7-84ca-4e07-a97d-ec2a85c3b525","resolution":{"observed_at":"2026-05-11T20:36:10.930578Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08895","last_updated":"2023-12-14T12:57:35Z","snapshot_observed_at":"2026-08-03T09:21:34.796627Z","submitted_at":"2023-12-14T12:57:35Z","title":"Motion Flow Matching for Human Motion Synthesis and Editing","version":1},"cited_work":{"arxiv_id":"2312.08895","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.08895","snapshot_observed_at":"2026-07-04T02:49:24.569820Z","title":"Motionflowmatchingforhumanmotionsyn- thesisandediting","venue":null,"work_id":"596b5ec4-d07a-4a27-a610-a68173739c5f","year":2023},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"cited_paper":"/paper/2312.08895","citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:7c5ad5611ad1cb0bfd90442ec646c19589d52dc6c0d44f238cc118c3b684b1ac","observation_id":"9606ba9f-c304-4210-b7e8-17f48d31c272","resolution":{"observed_at":"2026-05-11T20:36:10.891847Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient explicit joint-level interac- tion modeling with mamba for text-guided HOI generation","venue":null,"work_id":"a0d45fac-930b-4916-aaba-331643f8bf61","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:6f4eb70b6e4a4544ef1366e5674de477ed7be2ac204feb7e299fdaa279db17fb","observation_id":"9378658c-fa36-4901-9fdf-88f76f3b7640","resolution":{"observed_at":"2026-05-26T16:57:40.336456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Motiongpt: Human motion as a foreign language","venue":null,"work_id":"600f6102-0c93-4155-8b7e-ea9fede0a0e5","year":2023},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:847c9cfc389aae5af6725350bde506dbfd607e4e10bd99fdc029469c9f177e88","observation_id":"c8f333e8-0b5c-46a8-bc66-75629a224795","resolution":{"observed_at":"2026-05-26T16:57:40.390755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Local action- guided motion diffusion model for text-to-motion generation","venue":null,"work_id":"0b6638f3-c423-47b2-9868-36a6a6df966e","year":null},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:aa584ce57e6857cab5065413c973a2f9f26fa64977bc5567b842d8f3e257be3c","observation_id":"825d6df9-4747-4dc4-9bdf-67c0993e6661","resolution":{"observed_at":"2026-05-26T16:57:40.529467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pyramidal flow matching for efficient video generative modeling","venue":null,"work_id":"bd2e690d-bada-40cb-8240-99457ef9258e","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:d3f0256cfc1f3c6273e9378882bafa7d3938831dd9cb272d666a006b9cf1d7e6","observation_id":"65f203e7-4909-4f8b-8ac0-b4b7c89065fb","resolution":{"observed_at":"2026-05-26T16:57:40.470355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Guided motion diffusion for con- trollable human motion synthesis","venue":null,"work_id":"06696c16-e80f-4c82-86f9-ff44501404a5","year":2023},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:8b41125d5f5dd3d6882dab111acaa0fc4bbcdadde9095889736ed28ead3027be","observation_id":"b27475fc-5367-4701-bb7c-ecb862b4bcc7","resolution":{"observed_at":"2026-05-26T16:57:40.478537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Person- abooth: Personalized text-to-motion generation","venue":null,"work_id":"7bec85c6-ef40-431d-b535-6cb00a391ed5","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:2061739a5b35f83bb34af918e484fe3ee6eeb3e6f5cf542e289784ee8efcdc53","observation_id":"d4dccebc-24bf-4443-93ab-8ee32d7e7ceb","resolution":{"observed_at":"2026-05-26T16:57:40.516900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":"b5d0bad9-a940-4d46-8998-a0a462ee3d28","year":2015},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:6587dea712bc312df941fc3e1c607f2cf4e665282fb0f10594cc272822a92130","observation_id":"d6ac9172-70c8-4e94-865a-1b34f2c87cdc","resolution":{"observed_at":"2026-05-26T16:57:40.523074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Priority-centric human motion generation in discrete latent space","venue":null,"work_id":"04ce6266-ab8b-4829-ae5f-429801a57912","year":2023},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:95bb18171d4833c10e2111105c0a428f781f1b8909ff5488b39d7e1345af7ce6","observation_id":"3aa264bf-d1c6-4a50-9bca-7721472ee284","resolution":{"observed_at":"2026-05-26T16:57:40.307888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"62869e59-6488-4fbe-8642-7246efef27b6","year":2024},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:bd65b5370874c7ac0754eac797b26fe913614a6c95183ed49083113a1c47a0fa","observation_id":"96ac3bcb-aa03-4474-8734-f69d36db2d1b","resolution":{"observed_at":"2026-05-26T16:57:40.321722Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient text-to-motion via multi-head generative masked modeling","venue":null,"work_id":"ecaf0563-dca0-42af-9055-c73b4608386a","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:b5f8150ce9acf2e3adc13fdee53ffd46c19cb3a3a0ec32ca4e9a22efb4a584a2","observation_id":"e821557a-00a7-404d-b89c-2da14ce4ea25","resolution":{"observed_at":"2026-05-26T16:57:40.325179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.10730","last_updated":"2026-07-04T09:34:06Z","snapshot_observed_at":"2026-08-06T22:04:38.705956Z","submitted_at":"2025-12-11T15:16:06Z","title":"IRG-MotionLLM: Interleaving Motion Generation, Assessment and Refinement for Text-to-Motion Generation","version":2},"cited_work":{"arxiv_id":"2512.10730","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.10730","snapshot_observed_at":"2026-07-07T03:17:15.484473Z","title":"Irg-motionllm: Interleaving motion generation, assessment and refinement for text-to-motion generation","venue":null,"work_id":"bd4c8182-092c-408c-bb1e-2dd2a942e872","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"cited_paper":"/paper/2512.10730","citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:5f9f0e3613cfdf688cc56aec709477d0ed85f9f41b2a3a09f334caa29f0066bf","observation_id":"51fcdd3b-a67c-4edb-aa29-dc701edf6233","resolution":{"observed_at":"2026-07-07T03:17:15.484473Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Morph: A motion-free physics optimization framework for human motion generation","venue":null,"work_id":"023e3dfd-7546-478f-96c5-16d0dedbda68","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:69bda47a0703f55471a7c70276279e85a51780be161d15cc6d22c9a075f81d34","observation_id":"e133e33d-ef8f-45b0-be79-6ece97fb87a3","resolution":{"observed_at":"2026-05-26T16:57:40.318304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2f7eac2c-45ca-4c04-98ea-0983252b1d77","year":2023},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:5acb5ade37feff28438ff9a514e92f41b00c7f461dfdc6834a380a8f4189514e","observation_id":"5a31e269-2662-40df-8c45-e8f587509819","resolution":{"observed_at":"2026-05-26T16:57:40.304473Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flow straight and fast: Learning to generate and transfer data with rectified flow","venue":null,"work_id":"e7a76cc9-3e8c-4480-900d-b461823a5c54","year":2023},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:333475fb15212bd110a24b88013922c0c0a8fb993ea7f7d9929d11bfbd9183bc","observation_id":"c1d6554a-2be6-4001-9383-f45078464586","resolution":{"observed_at":"2026-05-26T16:57:40.329340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bridging the gap between human motion and action semantics via kinematic phrases","venue":null,"work_id":"28d5068e-8765-4a20-8ffb-7e7cfc58a965","year":2024},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:3b418299c8ad216e0dd24a577fc41c14fb6e2cff3b2d9dbd6cfd2d1536bbc91f","observation_id":"5561bbc3-aaa8-46de-8be7-ce2903fd6dc0","resolution":{"observed_at":"2026-05-26T16:57:40.311121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Humantomato: Text-aligned whole-body motion generation","venue":null,"work_id":"504ba154-39df-482f-acbd-f7e6b5634caf","year":null},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:c1f12f9484094931e7eee1305ab3c6460fedc22e2916c3aaba9533a1d0ba9c9f","observation_id":"1edac1ba-09be-46c5-b182-de276896ad19","resolution":{"observed_at":"2026-05-26T16:57:40.297643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scamo: Exploring the scaling law in autoregressive motion generation model","venue":null,"work_id":"7620c254-816f-41ea-8d10-136862fdc934","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:35747be2ddf3b0a5f2a44ef53f3abd0ba3f68d6124cfe70d0d1be96a00a9d82b","observation_id":"1f1e1638-240e-4feb-b409-7a839ee48ace","resolution":{"observed_at":"2026-05-26T16:57:40.301382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Progressively generating better initial guesses towards next stages for high-quality human motion prediction","venue":null,"work_id":"cf4bc09f-f973-40da-80b1-8b4800e98428","year":2022},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:b1eb22531d817d7c0be76afe77b994934457bf668d8fbe29ed24ec00c51e09ad","observation_id":"81afa1ab-1d86-425a-8d06-15813ccd1f9b","resolution":{"observed_at":"2026-05-26T16:57:40.314576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Amass: Archive of motion capture as surface shapes","venue":null,"work_id":"fc1b9325-2b04-4a13-98f1-aadf0758e214","year":2019},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:049fe1c99f970e675c287e53855ba1e8c39bb25fb264dc428a33d6927c0c617a","observation_id":"55cc6f33-d82a-440a-8cd2-f3ebd2d6c8d5","resolution":{"observed_at":"2026-05-26T16:57:40.462216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rethinking diffusion for text-driven human mo- tion generation: Redundant representations, evaluation, and masked autoregression","venue":null,"work_id":"b8ea2ace-7201-481a-8eb6-0241b4709caa","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:8d75f446e25c592f69c595c72cc4aa6e54859c9211aa45acedb1386242bd24b4","observation_id":"a2249fc6-c75e-4c29-8e8a-5d9116133cdb","resolution":{"observed_at":"2026-05-26T16:57:40.394056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"9836faf7-c0fd-4a8e-b409-12945f439132","year":2023},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:712818031d5fc82bd9e405a6c9158a91358c30a64574a943c749867a21dbdc7a","observation_id":"692715ab-f3eb-477c-99b4-347ad3adf9b5","resolution":{"observed_at":"2026-05-26T16:57:40.481864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Black, and G¨ul Varol","venue":null,"work_id":"f36992ca-9a58-4ca3-b620-27f04b8281e9","year":2022},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:4741e8443ae64036dd51fbf904150009492249ba1dd315a6f2e03c8ab88f44c8","observation_id":"94c8047e-cd28-41ee-a160-70add12ffc6b","resolution":{"observed_at":"2026-05-26T16:57:40.465949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"BAMM: bidirectional autoregressive motion model","venue":null,"work_id":"51d81800-3d69-44e4-8973-19c5f4a363ae","year":2024},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:679f4c794283ddd54bc8bb969245f753cfcf1f2ffe59a4e69e0b0f1cfe188a14","observation_id":"225954f0-0771-44d4-ac55-9208e98674b2","resolution":{"observed_at":"2026-05-26T16:57:40.458517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MMM: generative masked motion model","venue":null,"work_id":"a9da6b4b-a395-4dfd-b674-98a8fe437164","year":2024},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:0f1de79d5d46d340170cc885386c959bee7b75fd0d6ad948f773fe18b52ddbb2","observation_id":"05101b67-d9ca-4c5e-ae4c-868278db6f54","resolution":{"observed_at":"2026-05-26T16:57:40.452271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Maskcon- trol: Spatio-temporal control for masked motion synthesis","venue":null,"work_id":"95a16976-dfc8-4bda-a4da-7dfbe7b69848","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:c4e6a4017f188a4bd33f7ea32d09b603879d29e4cb943a952c5aa8b4e2000468","observation_id":"9130d37c-da0b-4813-a92f-801a3006e242","resolution":{"observed_at":"2026-05-26T16:57:40.455148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The kit motion-language dataset.Big data, 4(4):236–252","venue":null,"work_id":"ba41b808-10ca-4ef0-9e9d-5b9cc27439eb","year":null},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:94f061be69d8227e82fbabbdaa493595813a03970637587a9b22e21bfe5c003d","observation_id":"6430972f-bc11-47d1-a849-cca577bdeda6","resolution":{"observed_at":"2026-05-26T16:57:40.475227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"f2564372-0cf4-4e56-ae1c-080abefd4ca5","year":2021},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:737e020aaa362234d8224135f8b17b50ccfac1a91f2668625a2e0f6096f5e2ae","observation_id":"fd02ab1b-0d52-44a6-a46c-e7ce9f2cdf06","resolution":{"observed_at":"2026-05-26T16:57:40.526213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Realistic human motion generation with cross-diffusion models","venue":null,"work_id":"f0033270-a098-4eba-a946-6a59872b1274","year":2024},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:df0feab77f5b6fe0e0847cfb237ab8d0a821eeb667ffd949de47f8e338e430d2","observation_id":"f3204f7d-9c96-4fe0-a63a-8ffef8e623c8","resolution":{"observed_at":"2026-05-26T16:57:40.449259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Length-aware motion synthesis via latent diffusion","venue":null,"work_id":"77ceaca2-af31-40d1-9ea8-88daad0ece27","year":null},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:dddddb784fdf22b6221a0dfcb7e56a6713150fc0b2c4248904a7f66a8c68da8a","observation_id":"39316cc5-75a7-4670-acd5-7b6362e8a945","resolution":{"observed_at":"2026-05-26T16:57:40.513732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Two- stream adaptive graph convolutional networks for skeleton- based action recognition","venue":null,"work_id":"1e9ce7bc-f1b1-4830-a4b4-db0c01aec2be","year":2019},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:f5bec86fb0332dd8df1559f53977a2c2e0012dc7e72b2d10e5327da7198c9981","observation_id":"8fca15d8-a5e2-47a3-b958-9a7779045e2d","resolution":{"observed_at":"2026-05-26T16:57:40.443082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"026d9807-e486-42cb-97f1-5b178830c1fa","year":2024},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:c5284289abdcb5fd62548ded97405883b83c6bb631187930afebf523cad05324","observation_id":"2c7cfb17-17e2-4a4d-9293-689a922bd267","resolution":{"observed_at":"2026-05-26T16:57:40.434727Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Action-guided 3d human motion prediction","venue":null,"work_id":"c106df81-a1e3-4db9-9a57-821ec3c8cfa2","year":2021},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:bb8e14c4f845c5a27b646cedacf07c9a904c3fc6948edf1dcd84480472c1d40d","observation_id":"7cbcafae-cb34-4f3c-990d-e3a8921b0ea3","resolution":{"observed_at":"2026-05-26T16:57:40.439352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"You never stop dancing: Non-freezing dance generation via bank-constrained manifold projection","venue":null,"work_id":"804ea1d4-a1c0-4160-a99d-16e995eb8dac","year":2022},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:127a9ff8876a69537b220d38df98c51c9d1eb977281f3f0a0d8d26fab3ab2bd4","observation_id":"1eef0958-e235-4785-831e-3eaa4e6ea96f","resolution":{"observed_at":"2026-05-26T16:57:40.431038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Human motion prediction via continual prior compensation.IEEE Transactions on Pattern Analysis and Machine Intelligence, pages 1–16","venue":null,"work_id":"63ed95ce-64b8-438f-a8cd-c210a3f780b5","year":2026},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:35948273322683a0ea6270206dd4b1e33821e56bf8d1c2a872a103c162ebcdff","observation_id":"e576db59-99dc-4e4e-9eb1-65b1d6f827b4","resolution":{"observed_at":"2026-05-26T16:57:40.423217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Human motion diffusion model","venue":null,"work_id":"abfad4c1-5199-4d68-8407-d3049996ebef","year":2023},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:2110c5585198d207e427fe403d006e06df5626b550261eb91429f5abdc3b16c5","observation_id":"40130b94-b1ae-4e17-99ef-31ac113a81eb","resolution":{"observed_at":"2026-05-26T16:57:40.339842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"9c069dec-aed6-40aa-8ac7-431b3f4fbb01","year":2017},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:ebfe0280d56c7bbf219cb1ae57c269c2011e489e087fd217148f1faaf87d284b","observation_id":"132b7867-3546-479f-92b6-fa21d1dc5bce","resolution":{"observed_at":"2026-05-26T16:57:40.419574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tlcontrol: Trajectory and language control for human motion synthesis","venue":null,"work_id":"ee5ea654-9fcd-467c-98d2-4ad8898e0258","year":2024},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:610999f99916b6b2fd4bacff8e208c76bbf2732cda9ccfe57e35e27ce6ccdee7","observation_id":"130f085f-2aee-4fa0-8ffe-ec0ebcd7784f","resolution":{"observed_at":"2026-05-26T16:57:40.427494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"You think, you act: The new task of arbitrary text to motion generation","venue":null,"work_id":"2116bbee-bf39-4743-b3d2-850e348d9f36","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:b1bd9698b1345c9d0233bd0e8ee35c7a9a8f611dffc10bd17ee21668d451fdbd","observation_id":"2af7ee96-4f2a-4709-a1e7-abd745703e07","resolution":{"observed_at":"2026-05-26T16:57:40.446337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fg-t2m: Fine-grained text-driven human motion generation via diffusion model","venue":null,"work_id":"65d8c6fb-d178-44d2-9505-752c0b9dbd28","year":2023},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:9fb3de5d6a394ba6c30bb03711aa1a91e9ace1d49923d8dd0dfb1c20ec390b7c","observation_id":"fcb6b8b7-f4ff-401c-a748-44887e2c24e5","resolution":{"observed_at":"2026-05-26T16:57:40.504995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Motion-agent: A conversational framework for human motion generation with LLMs","venue":null,"work_id":"98acd3be-ddaa-4903-b08d-e59f76794e96","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:2fd78a11aad157232e88f228be6f0397523fd7f6fa5f4553fab9948e8729dc23","observation_id":"52d298f9-fdb2-44b5-98a2-3ee6c2cce1e2","resolution":{"observed_at":"2026-05-26T16:57:40.401940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Motionstreamer: Streaming motion genera- tion via diffusion-based autoregressive model in causal latent space","venue":null,"work_id":"1777e4d0-7d0e-4ea4-81b6-1d5024252f7f","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:4c381f7b79eb593438aca556f6593c035a99b8451642a64e4cda5126ed358c18","observation_id":"33ac02bd-4f38-414b-903b-02962f7f29f6","resolution":{"observed_at":"2026-05-26T16:57:40.416303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Omnicontrol: Control any joint at any time for human motion generation","venue":null,"work_id":"3fc559c4-5675-4301-84ed-14aa0b5003ad","year":null},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:8b5da9935f8d8d30b3c54573006c89281fede2ba17209b9e3f84bede2434182e","observation_id":"0e58edc0-6252-4fe7-8a08-e9ad9a3a6ce4","resolution":{"observed_at":"2026-05-26T16:57:40.376345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hamilton, and Jure Leskovec","venue":null,"work_id":"1c75d9f6-8454-465e-9079-1af8650aa5b7","year":2018},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:e1fb311b4ebf2ca91846914119906303f3886361d9537476a7f2d916c74daacb","observation_id":"8e2c8160-85db-4159-afb1-517c4a4ca765","resolution":{"observed_at":"2026-05-26T16:57:40.379511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mogents: Motion generation based on spatial-temporal joint modeling","venue":null,"work_id":"550a1394-a88f-4c35-b0c0-7c43b0a28f82","year":2024},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:a4e0c926a6ee442d51463078274e366cd2e97864b90a609dce1225d618e36882","observation_id":"d423eaa3-8bfa-4155-bed0-fd9226b65dac","resolution":{"observed_at":"2026-05-26T16:57:40.383055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chain- hoi: Joint-based kinematic chain modeling for human-object interaction generation","venue":null,"work_id":"5fc7df26-fe62-4565-acd2-9156a63334a5","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:ec020b6e212c5fdaefe8e3cfb89f95213623bdd31bb17e70e38fb7c634b29ed6","observation_id":"64a05f49-e9fc-4349-a0d3-b5bc0cf41e69","resolution":{"observed_at":"2026-05-26T16:57:40.386729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Light-t2m: A lightweight and fast model for text-to- motion generation","venue":null,"work_id":"7507b339-b54b-4b4e-9466-0f1bbbf7f878","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:0ecf70fe71bb598e5b8aa7af1ad4cddfd71a601ae95f6a377b1c539f925b238f","observation_id":"55426af3-ccfa-4c40-afda-485b3318e051","resolution":{"observed_at":"2026-05-26T16:57:40.405906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Progressive human motion generation based on text and few motion frames.IEEE Transactions on Circuits and Systems for Video Technology","venue":null,"work_id":"f4005347-2155-4db1-9aad-3f94b8cd3019","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:4b278b38bfb8f7f09a340126299d0afb9e0a9865d2d319e9feb20ef725137595","observation_id":"fc4cc489-02e4-4ed3-a745-973a77012276","resolution":{"observed_at":"2026-05-26T16:57:40.409415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generating human motion from textual descriptions with dis- crete representations","venue":null,"work_id":"d179356c-6e42-4e4a-a6f7-ea24ac1339cb","year":2023},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:3c98cb2e5450368e96a9ced932c3f55ffd859e19036799f07be51a511bbe6872","observation_id":"7498e153-552b-462a-9eda-d4e5f11daf72","resolution":{"observed_at":"2026-05-26T16:57:40.412720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Energymogen: Compositional human motion generation with energy-based diffusion model in latent space","venue":null,"work_id":"09852781-75cb-44f0-8d82-2b43c76f4507","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:d618532799de87e2baa9d4a89dc31527a0ceb33caeb0608822937d1d86a9460f","observation_id":"d34687bd-ee6e-48fa-a7e3-ebad8d874254","resolution":{"observed_at":"2026-05-26T16:57:40.498633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Re- modiffuse: Retrieval-augmented motion diffusion model","venue":null,"work_id":"f2c2d96f-9136-4058-af9b-cbe0f0a954d5","year":2023},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:cbf1ad724dcbe2ac82fa225a186ba782f7aefe2d092cef499401564458662221","observation_id":"216e5bd3-cf11-45a8-b47b-16cb7a6ce223","resolution":{"observed_at":"2026-05-26T16:57:40.501909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Motiondiffuse: Text-driven human motion generation with diffusion model","venue":null,"work_id":"8947febb-12a6-40a0-8761-c721471146ec","year":2024},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:5f251783074c630f44794944546a9fe55a8228df1f511447d2f6643b71b2e2c1","observation_id":"64d46beb-eb9e-49bf-ab39-23a7f4d3b9ec","resolution":{"observed_at":"2026-05-26T16:57:40.507987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards robust and controllable text-to-motion via masked autoregressive diffusion","venue":null,"work_id":"769c1133-69e3-4505-87df-3d252c357c14","year":2025},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:391a3df7ca6cfd435d0f0f19293a05da6760d90923836b3bb78e11c6086d1a76","observation_id":"dc9fe041-e29b-439c-8686-4d389128a311","resolution":{"observed_at":"2026-05-26T16:57:40.510808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Attt2m: Text-driven human motion generation with multi- perspective attention mechanism","venue":null,"work_id":"9d4286bc-cc5a-4fed-a8c6-a06a3036e249","year":2023},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:da21162fdb6e5611e7190bb34911e3a344c54bf862f1d7c9b64adb78576fc0dc","observation_id":"980befd4-524c-4376-9b1d-29aab4ad64b3","resolution":{"observed_at":"2026-05-26T16:57:40.488184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emdm: Efficient motion diffusion model for fast, high-quality motion generation","venue":null,"work_id":"a884da69-ac40-4e52-b9cf-e56773677bd8","year":2024},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:13a22185eface101647f04695e783441f748aa0495699a40036c1d5bd24fbe1d","observation_id":"b78907b1-1fcc-46cf-b470-6068eca9b5fb","resolution":{"observed_at":"2026-05-26T16:57:40.484951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Avatargpt: All-in- one framework for motion understanding planning generation and beyond","venue":null,"work_id":"0f82f041-02f3-4d2a-b2fd-e03b67eb93c2","year":null},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:436b498f7e17994bb40bb4cf9403e372f64567e330fa5787c1319e89a8f270f0","observation_id":"a6ffe9d0-f097-4184-b2f1-72870f04d7aa","resolution":{"observed_at":"2026-05-26T16:57:40.492067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Parco: Part-coordinating text-to-motion synthesis","venue":null,"work_id":"f8fb905e-7349-4b15-9a5a-9eeabbf98ec5","year":2024},"citing_paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-08T08:28:42.524111Z"},"links":{"citing_paper":"/paper/2604.23264"},"observation_digest":"sha256:57644444c257364e76c78b362c3aa2c2cb59d6b581975c8e6d2d13bd00e51325","observation_id":"10157e81-4c40-4669-ac50-e22e9287315d","resolution":{"observed_at":"2026-05-26T16:57:40.495223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.23264","last_updated":"2026-04-25T12:16:37Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T05:53:51.992744Z","submitted_at":"2026-04-25T12:16:37Z","title":"MotionHiFlow: Text-to-motion via hierarchical flow matching"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":3,"verified_exact":5,"verified_fuzzy":64},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 1 inbound Pith citation observation for arXiv:2604.23264."}