{"as_of":"2026-08-12T13:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d664504013435ad6e3bc66527e9b503b5b5b60ad91c6eb3b7f5a5f6f202553d9","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T21:59:00.831962Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:02:31.728467Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-12T13:02:33.216965Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"cited_work":{"arxiv_id":"2412.07797","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.07797","snapshot_observed_at":"2026-08-12T13:02:33.216965Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","venue":"cs.CV","work_id":"5c9b80a3-57f8-4aa9-8dac-09db71fb8437","year":2024},"citing_paper":{"arxiv_id":"2411.16575","last_updated":"2025-07-08T20:15:01Z","snapshot_observed_at":"2026-08-12T12:55:45.543098Z","submitted_at":"2024-11-25T16:59:42Z","title":"Rethinking Diffusion for Text-Driven Human Motion Generation: Redundant Representations, Evaluation, and Masked Autoregression","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:02:31.728467Z"},"links":{"cited_paper":"/paper/2412.07797","citing_paper":"/paper/2411.16575"},"observation_digest":"sha256:0927dbbd2fdf1501522dd38f77fc41f251da6f95d44569e635c9978955dcd63c","observation_id":"095fc63c-918d-48a3-b117-e1090b2bf474","resolution":{"observed_at":"2026-08-12T13:02:33.221375Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07797","snapshot_observed_at":"2026-08-03T12:14:47.331478Z","title":"arXiv preprint arXiv:2412.07797 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29180","last_updated":"2026-07-31T09:01:25Z","snapshot_observed_at":"2026-08-07T10:50:51.981505Z","submitted_at":"2026-07-31T09:01:25Z","title":"MoRAE: Flow-Friendly Self-Supervised Latents for Text-to-Motion Generation","version":1},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-08-03T12:14:47.331478Z"},"links":{"cited_paper":"/paper/2412.07797","citing_paper":"/paper/2607.29180"},"observation_digest":"sha256:dad05d0268296ada857affd81d0adcf0d8adfdaad1cb997cdeef982e3048d04d","observation_id":"1bf7fd6e-690c-40a7-9772-259cc52668af","resolution":{"observed_at":"2026-08-03T12:14:47.331478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.07797/citation-record","integrity":"/paper/2412.07797/integrity","json":"/paper/2412.07797/citation-record.json","paper":"/paper/2412.07797"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.234960Z","title":"Ahuja and L","venue":null,"work_id":"2889bbff-152f-41d3-bfce-bf2859c994d5","year":2019},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.695903Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:2f1809ab0500ba81dcad4475a9202df0ffcf76f95871c5e73e1154166b7b4d79","observation_id":"6fb30838-d2b7-48d2-b167-a2905e55aa3b","resolution":{"observed_at":"2026-08-11T21:59:01.238060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.699855Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.699855Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:72672f3403a8612f85132170f38d12697d318c3f7876d2706d2238ef54f2fa4e","observation_id":"0abc43f2-2dff-4e2a-aaa4-0efde6ebe489","resolution":{"observed_at":"2026-08-11T21:59:00.699855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-11T21:59:00.703233Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.703233Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:5b9ef8f53e0b6a13cb090c57f2a3cc443a34c4590acff25a37a0de48ce14229f","observation_id":"10497420-112a-4d41-873a-fccc4d4cad9f","resolution":{"observed_at":"2026-08-11T21:59:00.703233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.221141Z","title":"Deep video generation, prediction and completion of human action sequences","venue":null,"work_id":"659b3aeb-d7e0-40bd-b167-9358122b11b2","year":2018},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.707121Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:4bd9c1ac2a9e7cdd578fb0b89374ac7337ce0acf16cb8e2bd49b0cf5cf2c5eec","observation_id":"2a9f7fa6-3521-40dd-8a38-61c9b22c2d38","resolution":{"observed_at":"2026-08-11T21:59:01.224367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.212339Z","title":"Murphy, William T","venue":null,"work_id":"6dbcc1f2-7b71-47a8-bf3b-b1c8af703f7d","year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.710635Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:2cf5fc7fe32ee4cc8b096d86562aa8408188a077f21ca6dad4ec3eab8e7f88b8","observation_id":"2b0c43ad-793e-4598-87bb-8bd9890296e4","resolution":{"observed_at":"2026-08-11T21:59:01.215559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.203566Z","title":"Chen, Chengkuan Chen, Yicong Li, Tiffany Y","venue":null,"work_id":"eff6df38-db38-44ce-8442-ea6ac79f68eb","year":2022},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.713828Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:79ecda4962cb1ff619ff7712cbd256ed9164ec7033d74bc6d175a9d09a0c694c","observation_id":"8ca6b4db-b0b3-4352-96e1-67ee0f94941a","resolution":{"observed_at":"2026-08-11T21:59:01.206838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.194991Z","title":"Executing your commands via motion diffusion in latent space","venue":null,"work_id":"660d0098-72ab-4884-b9b3-e814e54976c3","year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.717107Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:5d1326a00324233f36bda9f56b4aca79677ba777ee737c605ccfc76b9fd74dbf","observation_id":"34e3737d-f557-4f3a-833d-6071691dcffa","resolution":{"observed_at":"2026-08-11T21:59:01.198102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.186328Z","title":"Transformer-XL: At- tentive language models beyond a fixed-length context","venue":null,"work_id":"d00dc7f8-96bf-4769-9656-fb23ce3cb9bb","year":2019},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.719984Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:70048d73e83d031f6d174a6e64c6d15faf1cb75f7627b3c9960f386ae0b164c8","observation_id":"f4f65d82-7e3c-4ef7-82ab-c6ee89c87ef6","resolution":{"observed_at":"2026-08-11T21:59:01.189323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.14217","last_updated":"2022-05-27T14:40:07Z","snapshot_observed_at":"2026-08-04T19:09:10.486489Z","submitted_at":"2022-04-28T15:51:11Z","title":"CogView2: Faster and Better Text-to-Image Generation via Hierarchical Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.14217","snapshot_observed_at":"2026-08-11T21:59:00.722886Z","title":"Cogview2: Faster and better text-to-image generation via hi- erarchical transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.722886Z"},"links":{"cited_paper":"/paper/2204.14217","citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:e8e1f2e4e10251374c7990c85b07bfc8b1251ce35b030581c070f35338591f71","observation_id":"371a702e-4539-496e-b139-e92be2e23988","resolution":{"observed_at":"2026-08-11T21:59:00.722886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.177193Z","title":"Synthesis of compositional animations from textual descriptions","venue":null,"work_id":"f81afd60-36dc-4667-9482-15df16ab008b","year":2021},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.726327Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:c8fb6bbe9bd5425fcfe35f6ad10f982a8fda85a6338a08d87aac74684098543a","observation_id":"06f081b0-d9aa-4ab7-8187-5c1370358c89","resolution":{"observed_at":"2026-08-11T21:59:01.180584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.167875Z","title":"Chatglm: A family of large language mod- els from glm-130b to glm-4 all tools, 2024","venue":null,"work_id":"73833c27-f436-4dbe-ac39-65d8471cfe3f","year":2024},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.729414Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:6bbf31c6245ab6360e5b64f57383b88b02839f489d732ca9101d9463d8fa218f","observation_id":"c56629a7-ab28-4330-8174-c3660c37555e","resolution":{"observed_at":"2026-08-11T21:59:01.171165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.158586Z","title":"Ac- tion2motion: Conditioned generation of 3d human motions","venue":null,"work_id":"0b2584b3-e01d-41c3-831d-b33af8cb31b4","year":2020},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.732295Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:eaa0bb0f64cc240b384a7b2fa0c9024e300398161840f3eb4fd1a09a56465ecc","observation_id":"487b197c-e4b7-4abf-acd0-578d374c419f","resolution":{"observed_at":"2026-08-11T21:59:01.161861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.149309Z","title":"Generating diverse and natural 3d human motions from text","venue":null,"work_id":"2bb083f4-c87a-4fcd-802e-b39acb326073","year":2022},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.735414Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:33d89771f02314c42cc4c9a2b0173c73797530ec6c8c6d71acbfd73bc161cb52","observation_id":"7ec22085-2a66-40af-bfe4-a03af86dc8d8","resolution":{"observed_at":"2026-08-11T21:59:01.152735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.139543Z","title":"Tm2t: Stochastic and tokenized modeling for the reciprocal gener- ation of 3d human motions and texts","venue":null,"work_id":"dbdda06f-a7db-4e97-85a4-6217a0aad71a","year":2022},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.738372Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:0b6d986979fc557feb865d57e221c72d4bbb7dbac2ce204f1554ec9f59ff69a4","observation_id":"e42ea98d-857e-4153-8dc8-0898d52557f9","resolution":{"observed_at":"2026-08-11T21:59:01.142870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.130263Z","title":"Action2video: Gener- ating videos of human 3d actions","venue":null,"work_id":"e2843c6f-3a68-4f5d-9425-f2e1013e3eff","year":2022},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.741655Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:40f8014813db53b8b537c520136954ad39d66650482087acf7e617c9fdfba9b8","observation_id":"191a0a08-1949-4844-a998-25481d12e03c","resolution":{"observed_at":"2026-08-11T21:59:01.133612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.120871Z","title":"Momask: Generative masked mod- eling of 3d human motions","venue":null,"work_id":"9b64cd36-b9d7-47f8-8117-a1fc7ac70ee8","year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.744455Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:8a93c75a12841d299e8176e3f0e07c54f63c3cdb3a3d215ae58b94988bff8c02","observation_id":"ad6ddf6c-f7f2-4efd-bccb-1d48f7906bc4","resolution":{"observed_at":"2026-08-11T21:59:01.124280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.111534Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":"9ed7d1e2-6699-4afa-a14e-3205d78b0eb5","year":2017},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.747324Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:4cc6272f302b3d9793d18ef3e5711830341e69987d60509d4d48731e04da60a6","observation_id":"e3acedc8-e1ed-4dc6-a7cd-30abd6d4ffcf","resolution":{"observed_at":"2026-08-11T21:59:01.114859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.101961Z","title":"Motiongpt: Human motion as a foreign language","venue":null,"work_id":"2667c6b0-ab26-470e-898e-3df4f9859102","year":2024},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.750590Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:09f4a7c8f59010dcbccd45e8a380e81b46d16e23776388da3bf2b5ed50ff8748","observation_id":"16173c95-e0b3-497f-9213-02e2fbbcaec1","resolution":{"observed_at":"2026-08-11T21:59:01.105666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.753425Z","title":"Brown, Benjamin Chess, Rewon Child, Scott Gray, Alec Radford, Jeffrey Wu, and Dario Amodei","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.753425Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:e1d5cb34fcf00dc4803c78f9e5aacf6e4ea046d971cba8a416c5e7752e89e1ab","observation_id":"4027dbb8-e875-4428-a895-789421a7c6a1","resolution":{"observed_at":"2026-08-11T21:59:00.753425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.00349","last_updated":"2023-01-01T11:46:43Z","snapshot_observed_at":"2026-08-12T06:41:02.178705Z","submitted_at":"2022-09-01T10:34:57Z","title":"FLAME: Free-form Language-based Motion Synthesis & Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.00349","snapshot_observed_at":"2026-08-11T21:59:00.756326Z","title":"Flame: Free- 9 form language-based motion synthesis & editing","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.756326Z"},"links":{"cited_paper":"/paper/2209.00349","citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:d08e2b51dd808a9ca9ade40ca39e3509eaca0ed121b5b7bdc0432d63ed48649c","observation_id":"00e661cb-c32c-43a9-b09c-7fe32fe7fb38","resolution":{"observed_at":"2026-08-11T21:59:00.756326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.088614Z","title":"Priority-centric human motion genera- tion in discrete latent space, 2023","venue":null,"work_id":"d7ea67d4-882b-4800-b880-fee0a924e048","year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.759533Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:efcfc3f81347bc6bbc4530fd2f7dbdd4e32a6ccf072479f37fca340cdef7c9cc","observation_id":"870e23f9-3b96-48f0-af03-ee061b3b6f2a","resolution":{"observed_at":"2026-08-11T21:59:01.091442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.079635Z","title":"Omg: Towards open-vocabulary motion generation via mix- ture of controllers","venue":null,"work_id":"c09a603d-7d8b-4e08-8396-6121f23b9823","year":2024},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.762290Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:0c69c8a3f6288d50f88610084c0a19907566f4e037b739d43a7e99e9e9c3bf00","observation_id":"138a9a06-a8d3-4f23-9e47-d901b8bd7e57","resolution":{"observed_at":"2026-08-11T21:59:01.082938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.765073Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.765073Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:424528f984d0ae7c8bcbf6b13e6362622708d17be9f343fc709bb8c9eb2f63a7","observation_id":"2edaea5e-b392-4e01-9331-6f9b0aa02848","resolution":{"observed_at":"2026-08-11T21:59:00.765073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.767522Z","title":"SGDR: Stochastic gradi- ent descent with warm restarts","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.767522Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:f88910489c0de60765a3ebd501566f6ce9d2daf066ce87209592b276f54056c3","observation_id":"4b49a8b0-5deb-4e10-a68e-1f672d622cad","resolution":{"observed_at":"2026-08-11T21:59:00.767522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.060221Z","title":"Troje, Ger- ard Pons-Moll, and Michael J","venue":null,"work_id":"f8794d1f-fc6a-4310-9e85-80d7e3a6d57b","year":2019},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.769898Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:12b47b157ab79c0e6b8c20e930ca98f337126b759bfee9ea4a5a2ca9fcb63e19","observation_id":"fa69ab03-75df-41bc-bc18-ef7ec7007537","resolution":{"observed_at":"2026-08-11T21:59:01.062954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.051125Z","title":"Hierarchical transformers are more efficient language models","venue":null,"work_id":"2f9e707d-4d97-42f8-b991-d12d476c84e9","year":2022},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.772292Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:f935bf6ecdd8b7a5951c88bef24de577a6e5db21828a6f0b9796d67a08b60c96","observation_id":"41b112ac-3cab-4f57-8ead-7681fb15b765","resolution":{"observed_at":"2026-08-11T21:59:01.054620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.041594Z","title":"Pappagari, Piotr ˙Zelasko, Jes´us Villalba, Yishay Carmiel, and Najim Dehak","venue":null,"work_id":"88a1b815-38fe-49ea-8d65-d8f80aa29b1b","year":2019},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.774893Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:daf58b6f9b0bb5cc2ab870a97c47a69620a524dc30917478672adaf83cd16f5b","observation_id":"1652bc0b-7399-4296-9280-ca8ea03800d3","resolution":{"observed_at":"2026-08-11T21:59:01.045073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.032384Z","title":"Black, and G ¨ul Varol","venue":null,"work_id":"b8017902-7ece-4ba8-a551-2f3bb6f92458","year":2021},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.777388Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:d36fcdc2c78550e6895dee08f3899c9e5ab09e88aa9faad9f9293d079cf3510e","observation_id":"ec8ebc47-3b3d-45b1-8680-a6b2408f7fae","resolution":{"observed_at":"2026-08-11T21:59:01.035630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.022988Z","title":"Mmm: Generative masked motion model, 2024","venue":null,"work_id":"c1f1a08b-a4b5-42f7-bcd1-7c176c5502ac","year":2024},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.779919Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:f9757aaf298091d7131eb721b27d6dc8501052a617abaedc69f919253a7241b6","observation_id":"6d0ae4e7-e484-4308-84e3-b1295a70f447","resolution":{"observed_at":"2026-08-11T21:59:01.026368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.782342Z","title":"The KIT motion-language dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.782342Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:7f09fa4b0639526d9d29cca3bfd2e8704c7be381667e47016e13b2a5e77bebe3","observation_id":"543b52f5-8712-4e4b-ad08-872580f1073f","resolution":{"observed_at":"2026-08-11T21:59:00.782342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.008477Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"c912c028-7fcc-49db-92a7-2483185151cc","year":2021},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.784997Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:8747f10c8611dbd419828e09b91d16af9ec8c4b220459cc7554d6d3b942764c7","observation_id":"a570f79b-a83a-4020-8383-de05fbf8ad0d","resolution":{"observed_at":"2026-08-11T21:59:01.012022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.787409Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.787409Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:774af3581e8794d8c62cd28b1ef74180cd82868039cfaf5575a0393d872ba4cf","observation_id":"4ff26f27-2295-4de5-bdda-a0c65d52e6a7","resolution":{"observed_at":"2026-08-11T21:59:00.787409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.790113Z","title":"High-resolution image syn- thesis with latent diffusion models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.790113Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:da989928bf32f518ed64a50f4684f8ea64fe76d0ba19b36f9702b2ab805b5142","observation_id":"5578ec87-20a5-44a8-b64c-d69f1ac873dd","resolution":{"observed_at":"2026-08-11T21:59:00.790113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.792904Z","title":"Human motion diffu- sion model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.792904Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:c95a273f82656a4657b79ea4d68bdf08312dc43b70c656fae6a0a1c3a83d1d36","observation_id":"b7791359-ef65-42eb-9c9a-7982d617842c","resolution":{"observed_at":"2026-08-11T21:59:00.792904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.983877Z","title":"Neural discrete representation learning","venue":null,"work_id":"83048dae-50f4-4624-9c2a-15b6ed2f3248","year":2017},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.795874Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:e4cceb9fd1f4ea869e6593acf9c2c4386a409d1982b9aa72fcc9b0f55f6eede7","observation_id":"0ffc5829-64c4-4ae0-82a7-16c3378224bc","resolution":{"observed_at":"2026-08-11T21:59:00.987049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.974727Z","title":"Shazeer, Niki Parmar, Jakob Uszkoreit, Llion Jones, Aidan N","venue":null,"work_id":"054d6134-f5a7-4d0f-b4da-4af258ec3ffc","year":2017},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.798745Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:77118034e2d4c90a2704eb8a92a2daab959ec3f91cca9447d9c8f774e94bd451","observation_id":"ebfdf256-4d57-4b52-9cdd-820cee900fd9","resolution":{"observed_at":"2026-08-11T21:59:00.977955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.965612Z","title":"Emu3: Next-token prediction is all you need","venue":null,"work_id":"ca7779bd-071a-4c74-889f-2a76ab5873c8","year":2024},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.801734Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:f7168261769c30068431dc200dcf67ab998e2f09a0db529be39870679558e15d","observation_id":"8d97ef13-934f-431c-b9e9-4076994f6272","resolution":{"observed_at":"2026-08-11T21:59:00.968914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.956676Z","title":null,"venue":null,"work_id":"03a5464f-8e75-405f-93f1-25617a33aa0e","year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.804552Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:97638f5c28f1925fa9b90ac445e55a19f906d4692583b3bf355ab692db8d7a07","observation_id":"9ed4050f-722e-4c11-b86f-aa0bfaa78df0","resolution":{"observed_at":"2026-08-11T21:59:00.959796Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.947536Z","title":"Learning diverse stochastic human-action generators by learning smooth la- tent transitions, 2019","venue":null,"work_id":"42dd3de9-dbe3-416f-9353-3bb0cec173c2","year":2019},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.807251Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:7f8ccbca981e1559e4ab43c790eaded2f3b56522d2eb44b842d315ab696fcf91","observation_id":"bd7df208-471d-4d83-ba42-70b328fd3867","resolution":{"observed_at":"2026-08-11T21:59:00.950974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.938973Z","title":null,"venue":null,"work_id":"7daf76c8-4433-48e3-9bc2-98801b39b616","year":2022},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.810209Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:9f7d47308bb529fd2de6244e9f7fd8ca2e322d6adc8f76c4f53b3307ad0d1f04","observation_id":"b7277666-5c22-4dd1-8106-12320ff4514e","resolution":{"observed_at":"2026-08-11T21:59:00.941781Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.930167Z","title":"Prompt engineering a prompt engineer","venue":null,"work_id":"43fd3b1d-709d-43bb-8c30-781f871aafc9","year":2024},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.813193Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:cb1249bcd5b32baf45a4bb41f8603b805b48023d776b374cad151f91a599c873","observation_id":"aa7b6365-8c65-4c1b-9d30-54ba70a0483c","resolution":{"observed_at":"2026-08-11T21:59:00.932918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.921497Z","title":"Animationgpt:an aigc tool for generating game combat mo- tion assets","venue":null,"work_id":"1133d36f-6a83-49ae-8609-e88b7ae61c28","year":2024},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.816187Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:de342291c54fdfcb01a87f6e6f12429e969724e5573e29c2f6323ef6aea31d57","observation_id":"24a65980-fac7-4e8d-a4aa-6efc565758e0","resolution":{"observed_at":"2026-08-11T21:59:00.924461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.912207Z","title":"T2m-gpt: Generating human motion from textual de- scriptions with discrete representations","venue":null,"work_id":"b74fac10-69f7-4407-b4a8-4603228a7ff1","year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.819345Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:0ab5f307bc664ee39949f07ded2f543d267710315ed54964466cd42138960e11","observation_id":"0be45cf8-430a-418d-b3e0-ba3f77804286","resolution":{"observed_at":"2026-08-11T21:59:00.915551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.15001","last_updated":"2022-08-31T17:58:54Z","snapshot_observed_at":"2026-08-09T16:31:06.714132Z","submitted_at":"2022-08-31T17:58:54Z","title":"MotionDiffuse: Text-Driven Human Motion Generation with Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.15001","snapshot_observed_at":"2026-08-11T21:59:00.822292Z","title":"Motiondif- fuse: Text-driven human motion generation with diffusion model","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.822292Z"},"links":{"cited_paper":"/paper/2208.15001","citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:cf36be2641ed87fe45598bd00da21b2254733c170325d6a76baaa3aace640ced","observation_id":"7e7ed5b1-c9f6-4366-abc9-bc6a5c19cf0a","resolution":{"observed_at":"2026-08-11T21:59:00.822292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01116","last_updated":"2023-04-03T16:29:00Z","snapshot_observed_at":"2026-07-06T15:11:32.429514Z","submitted_at":"2023-04-03T16:29:00Z","title":"ReMoDiffuse: Retrieval-Augmented Motion Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01116","snapshot_observed_at":"2026-08-11T21:59:00.825552Z","title":"Remodiffuse: Retrieval-augmented motion diffusion model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.825552Z"},"links":{"cited_paper":"/paper/2304.01116","citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:7a783071a162d2bcd1b92103e4255509fca29829a572d1ea60691ec090dc9f00","observation_id":"2aa3a18d-b925-46e7-8bcd-2cd6b1fd47fc","resolution":{"observed_at":"2026-08-11T21:59:00.825552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.902054Z","title":"Attt2m: Text-driven human motion generation with multi- perspective attention mechanism","venue":null,"work_id":"16ba5be3-65e1-48a2-9330-341929fff32f","year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.828914Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:35bf416f2c1532770aa4afd7e0070ad8e434bdb6649854af0b8bb649bb6550e3","observation_id":"27799f90-864a-41e7-817c-b4e83b2dfe2e","resolution":{"observed_at":"2026-08-11T21:59:00.906034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.891610Z","title":"walk like a monkey","venue":null,"work_id":"49101d12-9323-4a1f-be50-f14c87caf087","year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.831962Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:5c8f67b469157b8f38c29b213d02f953488411f6a944b62664a6c08ae5db3393","observation_id":"12118471-662c-4b4e-ab61-8b758bbd89a9","resolution":{"observed_at":"2026-08-11T21:59:00.895633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T21:51:18.199996Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":32},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 2 inbound Pith citation observations for arXiv:2412.07797."}