{"as_of":"2026-08-14T18:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:18151aa6b56450a64fb086bb375fca4763ea9a6cd95aafa675aaef44b383595b","coverage":[{"denominator":71,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":71,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T20:31:41.257124Z","state":"measured"},{"denominator":71,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":71,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.23517/citation-record","integrity":"/paper/2607.23517/integrity","json":"/paper/2607.23517/citation-record.json","paper":"/paper/2607.23517"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/iccv.2015.226","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Crandall and Chen Yu , title =","venue":null,"work_id":"9e82e05e-42d5-4120-aa3a-06a2c6f81263","year":2015},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:36.263572Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:0457afac83037095ee9b425ac1bdbb02689cd9f4a4be46be83d07f375e675a51","observation_id":"3afdad76-5f4a-4fbb-a47a-1234bc7f58fb","resolution":{"observed_at":"2026-07-30T20:36:17.396644Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5244/c.25.75","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"378c20cd-1302-419e-b5fb-abda96e59260","year":2011},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:36.369939Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:58277b00472cbfe2491294c29c8782d53f5fe860f9c288993390ced6ca1ef8a3","observation_id":"d3804d12-8429-481f-bc00-c5d74a9caadf","resolution":{"observed_at":"2026-07-30T20:36:17.261935Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:36.520562Z","title":"GanHand: Predicting Human Grasp Affordances in Multi-Object Scenes , booktitle =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:36.520562Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:8de566eb68b06c167b24aed6eedb192278b7fa71c1c7db65dcc39a3e628a6659","observation_id":"7e7e45f3-ccd9-4170-98bf-8000b14a5954","resolution":{"observed_at":"2026-07-30T20:31:36.520562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:36.567154Z","title":"Black and Krikamol Muandet and Siyu Tang , editor =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:36.567154Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:73a7910312b0f0ce56d36c30df671fa68bc18bb5a6c8d08050f173eb7b882474","observation_id":"4d19f102-cf3d-40d4-8ed6-49205c867f7b","resolution":{"observed_at":"2026-07-30T20:31:36.567154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:36.645745Z","title":"Computer Vision -","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:36.645745Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:4c87b57b207ccbaa5a6787746c8ac92c3138101408a765c1ce57cb386c28012c","observation_id":"c1b69409-7446-4c25-bcd4-5554f61f0d03","resolution":{"observed_at":"2026-07-30T20:31:36.645745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:36.751412Z","title":"2023 , url =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:36.751412Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:41dc73ea1254589877d8d51bdf1ab56290c288badbf568bfea244a1f3977666d","observation_id":"2f257191-a993-438c-893d-39729d4ea70d","resolution":{"observed_at":"2026-07-30T20:31:36.751412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:36.791997Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:36.791997Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:c1e7ba4fdb8749bbc620affcb2fb4b577783656cc4185c41bb0f0fa982426c57","observation_id":"194a88ba-bef7-48ce-8888-b413ee002f7b","resolution":{"observed_at":"2026-07-30T20:31:36.791997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-72940-9","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Karen Liu , editor =","venue":"Lecture notes in computer science","work_id":"f714358b-454d-4251-ae6f-da8fd6273f24","year":2024},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:36.915087Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:ec9dfd0bf3e030ed098f07c0d130902c33a4a904f35d1bc2bd00c1dc11e9235d","observation_id":"bb494003-4146-4212-9f0f-55d2e831e64c","resolution":{"observed_at":"2026-07-30T20:36:16.961958Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:36.969259Z","title":"Grasp as You Say: Language-guided Dexterous Grasp Generation , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:36.969259Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:298890f9f2d63d338bf047d54f422eb5472fd18adc2f19f27fcfac362a6aab94","observation_id":"d008da3b-c881-416c-81dc-87c0b2d44b96","resolution":{"observed_at":"2026-07-30T20:31:36.969259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03168","last_updated":"2025-02-28T14:39:17Z","snapshot_observed_at":"2026-08-13T23:43:50.484861Z","submitted_at":"2024-07-03T14:41:39Z","title":"LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03168","snapshot_observed_at":"2026-07-30T20:31:37.042647Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:37.042647Z"},"links":{"cited_paper":"/paper/2407.03168","citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:866ace260817caff37e56c9434c0d2c2d43143e9a702b79eec6dfbc05cfa1f9c","observation_id":"ddb5892a-390b-40b3-ad5d-14ac65cb36ee","resolution":{"observed_at":"2026-07-30T20:31:37.042647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:37.094165Z","title":"The Thirteenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:37.094165Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:16bda8a46ed7196fe3c6066a07627ff479878a4dc4285094fefe2dc1ffea5435","observation_id":"bcaad250-ce20-4343-b82d-c9e873ea6065","resolution":{"observed_at":"2026-07-30T20:31:37.094165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:37.167804Z","title":"Follow-Your-Emoji: Fine-Controllable and Expressive Freestyle Portrait Animation , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:37.167804Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:d65bfb3155451f1df7c99c83734b036c58c9333d2c3bcab7215016ee75517b3b","observation_id":"ba37edc4-4f71-4517-a5d5-77920a884e9d","resolution":{"observed_at":"2026-07-30T20:31:37.167804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:37.242306Z","title":"X-UniMotion: Animating Human Images with Expressive, Unified and Identity-Agnostic Motion Latents , booktitle =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:37.242306Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:6a48b04004b5f82b14218735768dbae83f22500c68b2ae6008d0e14eab3c5b0f","observation_id":"66e7cd53-4d92-42c4-a1f5-80296035a66a","resolution":{"observed_at":"2026-07-30T20:31:37.242306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-12T07:46:13.550482Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-07-30T20:31:37.313465Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:37.313465Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:c1ba9bd76ea3b5495f6fc74240a8cd13a4afd63b9084c63b5adc48876f6de4ed","observation_id":"0d9ffe17-fe43-4466-a0d0-1fb2ddc4e150","resolution":{"observed_at":"2026-07-30T20:31:37.313465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:37.367619Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:37.367619Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:521baab4b6e6541a40f76e179b1038ab6d9968144752a429b36954f2aa10fb34","observation_id":"0a62833d-97ce-49e9-bf9d-90c43f5d072b","resolution":{"observed_at":"2026-07-30T20:31:37.367619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:37.447707Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:37.447707Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:38eaeed6bfb84930dc0d85b5b1423c6acff42899faa9d2ddf593aaaee2152ac2","observation_id":"f8a1a64c-7490-43fd-94f3-a32ce31064b4","resolution":{"observed_at":"2026-07-30T20:31:37.447707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.07498","doi":"10.48550/arxiv.2602.07498","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"IM-Animation: An Implicit Motion Representation for Identity-decoupled Character Animation , journal =","venue":"Open MIND","work_id":"cdb274bc-ba03-494c-aedb-403124a53199","year":2026},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:37.530329Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:2e243340b56f67f82213feee4882289b57c646b73f7d5b0a8aa52cc6e655ca91","observation_id":"c7435932-cc95-424c-aa7a-55fef5ad569f","resolution":{"observed_at":"2026-07-30T20:36:16.795028Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:37.590642Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:37.590642Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:feb80c87fe5fe17f860939e5c5260cedf89a246f29cdb5074e24df99d29e5908","observation_id":"481a3551-01a6-4c85-a4bf-04fc8e169db5","resolution":{"observed_at":"2026-07-30T20:31:37.590642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:37.637562Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:37.637562Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:8ff2dea06d35c55be6a8b73168f8de844a240dd209c4457b9c54f96378ec7d10","observation_id":"0207087b-dedc-42c1-8a08-aa454dafb161","resolution":{"observed_at":"2026-07-30T20:31:37.637562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21552","snapshot_observed_at":"2026-07-30T20:31:37.693877Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:37.693877Z"},"links":{"cited_paper":"/paper/2506.21552","citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:b9506227c69c221af9fa338078e8efdd79fc12989a18cafda38bf9c0743bff3d","observation_id":"eef0f0c6-302b-440c-ae7d-2229b709231e","resolution":{"observed_at":"2026-07-30T20:31:37.693877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:37.761913Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:37.761913Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:7c38f6aa7a5426a09a952538049794f4aa41ba5adbc4f633d8e68795dd905942","observation_id":"81f48d84-0619-4f1e-95e3-688f37402288","resolution":{"observed_at":"2026-07-30T20:31:37.761913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:37.826651Z","title":"Dennis and Ashley Edwards and Jack Parker","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:37.826651Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:43c0c6d3208f4c16d166d4c89cf95235a95fb37b99995b9f0c7dba3718f891ac","observation_id":"ae5a1b69-74d5-4dcc-9f17-71f2382fd664","resolution":{"observed_at":"2026-07-30T20:31:37.826651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13009","last_updated":"2026-04-07T11:37:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-18T15:28:53Z","title":"Matrix-game 2.0: An open-source real-time and streaming interactive world model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.13009","snapshot_observed_at":"2026-07-30T20:31:37.887164Z","title":"Matrix-Game 2.0: An Open-Source, Real-Time, and Streaming Interactive World Model , journal =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:37.887164Z"},"links":{"cited_paper":"/paper/2508.13009","citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:0467595043bcc6277885bc82ccbed3ee727bcbf49accbfe7aa054112ef1d19a1","observation_id":"b7c019e5-6062-4c29-ad5a-fb97c81605aa","resolution":{"observed_at":"2026-07-30T20:31:37.887164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17201","last_updated":"2025-06-20T17:50:37Z","snapshot_observed_at":"2026-08-14T08:02:32.611533Z","submitted_at":"2025-06-20T17:50:37Z","title":"Hunyuan-GameCraft: High-dynamic Interactive Game Video Generation with Hybrid History Condition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17201","snapshot_observed_at":"2026-07-30T20:31:37.953713Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:37.953713Z"},"links":{"cited_paper":"/paper/2506.17201","citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:acf0ed6c5b6fd1d3b633d4d3d699fb09c1858f3bbb55936049d14210e17d5061","observation_id":"6ac86d26-db58-4995-abb6-2b02fc6e34e6","resolution":{"observed_at":"2026-07-30T20:31:37.953713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:37.997574Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:37.997574Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:bedc3fb4e21a82e59706e6a60b82bf833b8c9333f79d482b075c5a1e073573f9","observation_id":"55fd3d65-39aa-42b3-8459-0b3ea21c59ca","resolution":{"observed_at":"2026-07-30T20:31:37.997574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-08-12T01:27:32.593496Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-07-30T20:31:38.043053Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:38.043053Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:578dd7538b08589fe03818167e968038ec460433e5343c45bacd3f855520d419","observation_id":"7904492c-a1dd-4ab1-b01a-7db1369b0c4a","resolution":{"observed_at":"2026-07-30T20:31:38.043053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07598","last_updated":"2025-03-11T06:44:25Z","snapshot_observed_at":"2026-07-06T20:50:05.070886Z","submitted_at":"2025-03-10T17:57:04Z","title":"VACE: All-in-One Video Creation and Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07598","snapshot_observed_at":"2026-07-30T20:31:38.101526Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:38.101526Z"},"links":{"cited_paper":"/paper/2503.07598","citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:d98bfc4289d5ed30b6d5b4f51c1d5ceb1599aaaac1d7259a1233977828d97571","observation_id":"bfb554e4-df19-4544-aa3f-939bf338909d","resolution":{"observed_at":"2026-07-30T20:31:38.101526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:38.145099Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:38.145099Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:d964c7a7e705b90160dc1544528f7298d8e6c5925e1868a1ff1c5faef4b816a6","observation_id":"c765e226-e33c-48dc-97b4-b16572ffdf62","resolution":{"observed_at":"2026-07-30T20:31:38.145099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:38.191832Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:38.191832Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:70c25d2e5bbbd535f9aa6b69b5814e0756445a1ab0fac0f68d48c6eaf404a6ff","observation_id":"a85bd7b0-10c9-49b6-8622-6381d0bcabf0","resolution":{"observed_at":"2026-07-30T20:31:38.191832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:38.261024Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:38.261024Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:ef9c9291619450499f690d2182010c96f4ff354a0b629c262397dc167add9d48","observation_id":"49b1f109-3f29-4904-bc44-5dc729044025","resolution":{"observed_at":"2026-07-30T20:31:38.261024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:38.318042Z","title":"The Thirteenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:38.318042Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:c954e4a229c38b5c285fb6006ea23a19df8ec5b99e47f2a67a3e74df9fe9c19c","observation_id":"07b0a112-83cd-412f-8c92-1b7938afb659","resolution":{"observed_at":"2026-07-30T20:31:38.318042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:38.379816Z","title":"2025 , url =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:38.379816Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:83f046563eb85e87b341867b79708f0ba04992525759a87a1f88ce458f52b894","observation_id":"0b9b5350-aae2-4f42-9cb2-7b4a10eea55a","resolution":{"observed_at":"2026-07-30T20:31:38.379816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17383","last_updated":"2025-06-23T06:27:21Z","snapshot_observed_at":"2026-08-13T13:22:13.959413Z","submitted_at":"2024-11-26T12:42:13Z","title":"AnchorCrafter: Animate Cyber-Anchors Selling Your Products via Human-Object Interacting Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17383","snapshot_observed_at":"2026-07-30T20:31:38.445477Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:38.445477Z"},"links":{"cited_paper":"/paper/2411.17383","citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:a3c7522c415501f3b854f813c5cde0124038d6dd510f53d5941f7c77d1780737","observation_id":"25ae52db-09d1-4150-ba75-d6a511387c01","resolution":{"observed_at":"2026-07-30T20:31:38.445477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:38.561570Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:38.561570Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:373abdcda680dcdca4fd3eead4de71f0fc3d7dec9d669ff73970a66d964b5463","observation_id":"77e075b0-d002-4a29-b3c7-6d533824fca4","resolution":{"observed_at":"2026-07-30T20:31:38.561570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08519","last_updated":"2025-09-10T11:54:29Z","snapshot_observed_at":"2026-08-10T10:23:44.624492Z","submitted_at":"2025-09-10T11:54:29Z","title":"HuMo: Human-Centric Video Generation via Collaborative Multi-Modal Conditioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08519","snapshot_observed_at":"2026-07-30T20:31:38.681716Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:38.681716Z"},"links":{"cited_paper":"/paper/2509.08519","citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:d9506d5b4c664b1cb085d1ec43ef077d4654b926323fff5b6320ff50f86817dc","observation_id":"99433b28-261f-4369-903d-a30387fef95f","resolution":{"observed_at":"2026-07-30T20:31:38.681716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:38.802334Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:38.802334Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:77508adbdb1fa23476b530aec390ef076eb6373084d77f3b25cfbc824f7be9f3","observation_id":"ae10cc63-2a82-402b-9541-709c3ac548ea","resolution":{"observed_at":"2026-07-30T20:31:38.802334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22960","last_updated":"2026-06-29T11:22:33Z","snapshot_observed_at":"2026-08-14T12:23:22.280746Z","submitted_at":"2026-02-26T12:54:46Z","title":"UCM: Unified Modeling of Camera Control and Memory with Time-aware Positional Encoding Warping for World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.22960","snapshot_observed_at":"2026-07-30T20:31:38.878705Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:38.878705Z"},"links":{"cited_paper":"/paper/2602.22960","citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:e4b46fdadcc12581dcf6e569f915e21bd245538fdccf3a4161d40795edd3f1bc","observation_id":"f9754a20-00e6-493c-bd88-43097f336a29","resolution":{"observed_at":"2026-07-30T20:31:38.878705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:38.947695Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:38.947695Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:2b15301d3ce07bc44e86706491d20c7369ae10145689586e8399e0dc0df320e1","observation_id":"67d9c241-af69-4432-ac9d-aa02a52da766","resolution":{"observed_at":"2026-07-30T20:31:38.947695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:39.001639Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:39.001639Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:ab0dc228bbf7e87155bf0087ff6c81d5ec8b318e080ee93932b50a2e338a843d","observation_id":"2999f501-b0d4-440f-aa0d-f14cc281dd86","resolution":{"observed_at":"2026-07-30T20:31:39.001639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:39.042515Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:39.042515Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:763b54b1e1649a9c08e1c41be7d06b3ad355b0c1d6fa0d23191512ce5934a073","observation_id":"73764523-fcb4-4780-a965-5339b797c5e0","resolution":{"observed_at":"2026-07-30T20:31:39.042515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:39.109603Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:39.109603Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:8eac6666f7e353e6247efb588cdd47735199bd81d75d77ba66febcc6c573734f","observation_id":"97ed24c3-f836-4e7d-9236-2f11b6b699aa","resolution":{"observed_at":"2026-07-30T20:31:39.109603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:39.224256Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:39.224256Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:79d7143bd27098f0e31063505aef6a4446667f6252533a3aaf64dd4f05490b3b","observation_id":"9ac91b86-ba66-4b6a-b980-7a717be0d5a7","resolution":{"observed_at":"2026-07-30T20:31:39.224256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:39.283268Z","title":"First Order Motion Model for Image Animation , booktitle =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:39.283268Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:ea5d04cadfa4d8292ec8cfd747af8a978ea138c4455d2930fbb2c20e6bf9fbc6","observation_id":"a54ca49d-abfa-4b3a-a12e-11f4e0f4d66d","resolution":{"observed_at":"2026-07-30T20:31:39.283268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:39.352785Z","title":"International Conference on 3D Vision (3DV) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:39.352785Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:3b8ead4b034bfc601b277c6860ef08d7dbfaec99ce648d5567f23ae48084c456","observation_id":"f43e0134-b445-44d4-b9b1-d436d4bb42a2","resolution":{"observed_at":"2026-07-30T20:31:39.352785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:39.448761Z","title":"T2I-Adapter: Learning Adapters to Dig Out More Controllable Ability for Text-to-Image Diffusion Models , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:39.448761Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:fc999ae158e0f439b26f0ade93e6e3429996fd8c2b124e03f055580adb34b8b4","observation_id":"4b2d49a5-f47e-4a52-9a4f-ee29ef0b0129","resolution":{"observed_at":"2026-07-30T20:31:39.448761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:39.631870Z","title":"2018 , eprint=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:39.631870Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:18c3b7461b17f50ed43b97929ac501f21823f747d72997ea0efcb176eefa543f","observation_id":"9f44db19-bb75-4009-9eed-fc8463a984a7","resolution":{"observed_at":"2026-07-30T20:31:39.631870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:39.723741Z","title":"Petrov and Cristian Sminchisescu and Christian Theobalt and Gerard Pons","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:39.723741Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:64a9d946de7f0645d08cb17fc6d24cb67a73ce9e60b481b663c664094a693e5b","observation_id":"a462452e-9b32-4900-ba13-3afeb1a84bae","resolution":{"observed_at":"2026-07-30T20:31:39.723741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:39.805748Z","title":"Computer Vision -","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:39.805748Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:459016e48724a7751aa86a338b69c9512b1282045dfe6d4c9d70e4ce4afb2e4d","observation_id":"fe1b584c-ecea-4513-acd6-8e6c891975ac","resolution":{"observed_at":"2026-07-30T20:31:39.805748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:39.910305Z","title":"DexMV: Imitation Learning for Dexterous Manipulation from Human Videos , booktitle =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:39.910305Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:418cd5b4d7eda26f09934ca7bb50fb0c2ede333a9e3adab3c2e204a6dddb3841","observation_id":"52c8ccc8-07d0-43cb-89bf-e03970fcb377","resolution":{"observed_at":"2026-07-30T20:31:39.910305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:39.995616Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:39.995616Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:d9e454b89c1a7e9174e2302c4d066fafaa0137074978bcafc724bf8414c7f63f","observation_id":"af91c4e6-63a7-489c-9b60-032cb8cb596b","resolution":{"observed_at":"2026-07-30T20:31:39.995616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:40.000272Z","title":"Guibas and Mustafa Mukadam and Abhinav Gupta and Shubham Tulsiani , title =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:40.000272Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:ad534a08073e9b5f36cb80c5b3aace5161d2ec5e18fd74cea08a7dff2356d9c8","observation_id":"ff660f4d-3c45-4d46-8b04-274881c48068","resolution":{"observed_at":"2026-07-30T20:31:40.000272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:40.075573Z","title":"2018 , copyright =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:40.075573Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:ebcb5428398ade2e4042604aa831f4368fc247809dc5960321ed35ea43d89fe4","observation_id":"65202f83-db4b-4b33-95f1-de197e5fda30","resolution":{"observed_at":"2026-07-30T20:31:40.075573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-07-30T20:31:40.175001Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:40.175001Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:15b2e03343a6790aa5343daa765b0d070bb21adc9faac3db3a67467870d04a30","observation_id":"d7829c99-0040-4bf9-b61d-d1c0c4d78f8b","resolution":{"observed_at":"2026-07-30T20:31:40.175001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:40.246117Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:40.246117Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:893f939f840b7f67fda63086460a87d5d06b128ce8415cdd72d1c4b0cf0350b5","observation_id":"6bfab19f-dbaf-427f-b6b1-5f95c280a5f8","resolution":{"observed_at":"2026-07-30T20:31:40.246117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:40.315689Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:40.315689Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:782cdbfaffb964ac978b18a0cd7d8f48c20c0f54bbc3e4932351185bfe0093f3","observation_id":"96176857-0344-4ef7-85e1-3ed0756c4c96","resolution":{"observed_at":"2026-07-30T20:31:40.315689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:40.389924Z","title":"Follow Your Pose: Pose-Guided Text-to-Video Generation Using Pose-Free Videos , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:40.389924Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:38c56fe179db98cc6af535c7d2b1b0a15eee409c891459b6435de972d4bfd5c6","observation_id":"a6bb0237-e826-4107-b09b-973d3e3a9a14","resolution":{"observed_at":"2026-07-30T20:31:40.389924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10568","snapshot_observed_at":"2026-07-30T20:31:40.443745Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:40.443745Z"},"links":{"cited_paper":"/paper/2506.10568","citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:beeac158de052e62d6e871d0e80634c19a13130c085bbd94312feabfbfa8cdd6","observation_id":"1eb057ca-a024-4d21-a2f5-a56dab73fdbe","resolution":{"observed_at":"2026-07-30T20:31:40.443745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:40.493470Z","title":"2019 , eprint=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:40.493470Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:501f1f2c742f451b0ac0a8c884f62b973737e9acc67b37a17a26ac31d1625829","observation_id":"bf9cc972-906e-45c7-9fff-79e523a77139","resolution":{"observed_at":"2026-07-30T20:31:40.493470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:40.553727Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:40.553727Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:0b3b6c815ada9096e416dae20c9bf766a6b39b448b210e9cfb817eb5694a22c3","observation_id":"2fad2235-1009-4f98-ba37-852f1eca5b15","resolution":{"observed_at":"2026-07-30T20:31:40.553727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:40.619820Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:40.619820Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:82e33dc4013b9d9715be9f76841705e54d41f4f42d00f7476b19da92f1a17933","observation_id":"0ca9150b-505c-4c2b-b519-5ec5e8e7b60b","resolution":{"observed_at":"2026-07-30T20:31:40.619820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:40.679418Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:40.679418Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:1263289f42b1fbc2e6e6bdeced62bb4fabe2aa3d711517cee91d1b1fd6938fba","observation_id":"188653da-b884-4801-9b50-247355407c28","resolution":{"observed_at":"2026-07-30T20:31:40.679418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:40.738333Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:40.738333Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:b0a54ea2219d380a22c60b5ff47839feeced944c98a4663fde322cf5da5a51c4","observation_id":"89c53c3a-6750-4bb4-be7f-c06a62746d66","resolution":{"observed_at":"2026-07-30T20:31:40.738333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:40.808823Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:40.808823Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:27a41c034fc9daf5bffe15dc92d72086fd9aea0e4c7c24d6e3f42931cd1e2296","observation_id":"0fb85838-4feb-4e32-be22-588d009ae35f","resolution":{"observed_at":"2026-07-30T20:31:40.808823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-07-30T20:31:40.885567Z","title":"arXiv preprint arXiv:2503.20314 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:40.885567Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:c1fc8ddb2bd69f50d60b401a251d563ecfdb43bcad1c845973e2fbf02ddb28e3","observation_id":"74d2afc8-3332-458e-bc13-c02b5a09c80b","resolution":{"observed_at":"2026-07-30T20:31:40.885567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:40.924645Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:40.924645Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:a4c473be408c9f1cc5026f9c46af351ebc5f41e5c6fd3f96ed9ddbb932d6e819","observation_id":"2878fa7c-dfdd-4771-9c41-0e4684d32bfd","resolution":{"observed_at":"2026-07-30T20:31:40.924645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:40.940651Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:40.940651Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:723a5758a11810d7cacffea447dae1b1cfcb6c5d3db2e4e7df683a8186562c9b","observation_id":"5ef273f2-324c-4ccf-b675-f217cbd9e633","resolution":{"observed_at":"2026-07-30T20:31:40.940651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:41.000724Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:41.000724Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:230bd6abb034dcfea4c20fe220ccb9b98e4cfdb5f1b105ae8e2b4c3dcb846376","observation_id":"73b4e71d-6cfc-40d6-9890-42c43d79ab59","resolution":{"observed_at":"2026-07-30T20:31:41.000724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:41.063180Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:41.063180Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:d1a70129c0f6ffbfc2ec3a4ba0797a1ee1686796dfb209393a7f3052e3cca49e","observation_id":"be147906-32a7-479b-87fd-0ae9ecd49fd2","resolution":{"observed_at":"2026-07-30T20:31:41.063180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:41.127435Z","title":"Ni and Heung","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:41.127435Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:5c3b6af5759d198166825b2d9d8ec7c522acf6c0fb2b6d30812fd68433649e37","observation_id":"ba5ce9b4-2541-4d15-b4a0-31334fcc190f","resolution":{"observed_at":"2026-07-30T20:31:41.127435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:41.193342Z","title":"Reconstructing Hands in 3","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:41.193342Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:34ff49d50a0d10fd28e55bb2053322e6e8d5f4475189155fdd8e8359eb517397","observation_id":"74d7e722-1c0a-46db-a821-1d4f73567c93","resolution":{"observed_at":"2026-07-30T20:31:41.193342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:31:41.257124Z","title":"ArcFace: Additive Angular Margin Loss for Deep Face Recognition , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:41.257124Z"},"links":{"citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:682b9702d4829256e5020981dedfa747317cf514bd20227ea14a7a002cf92536","observation_id":"119921db-d92b-424e-9436-c74c66d15882","resolution":{"observed_at":"2026-07-30T20:31:41.257124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction"},"reference_resolution":{"displayed":71,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":67,"verified_exact":4,"verified_fuzzy":0},"total_outbound_references":71},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 0 inbound Pith citation observations for arXiv:2607.23517."}