{"as_of":"2026-08-20T21:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0364a3048c358561169762d293ceb09ccd1614c192f5be7eec435815c9194d63","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:27:39.743523Z","state":"measured"},{"denominator":92,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":92,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:09:52.059140Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T13:47:57.562132Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10568","snapshot_observed_at":"2026-08-06T15:09:52.059140Z","title":"Dreamactor-h1: High-fidelity human-product demonstration video generation via motion-designed diffusion transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16813","last_updated":"2025-07-22T17:59:21Z","snapshot_observed_at":"2026-08-16T23:44:10.641835Z","submitted_at":"2025-07-22T17:59:21Z","title":"HOComp: Interaction-Aware Human-Object Composition","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T15:09:52.059140Z"},"links":{"cited_paper":"/paper/2506.10568","citing_paper":"/paper/2507.16813"},"observation_digest":"sha256:e855ba5f41725ca4f3111da08b10c467e8d6a404c5a69d3dbf3dcc96e80098ac","observation_id":"b382ba05-d73c-4728-9785-9a213ceaca1e","resolution":{"observed_at":"2026-08-06T15:09:52.059140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10568","snapshot_observed_at":"2026-08-05T18:34:29.046999Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.14465","last_updated":"2025-08-20T06:40:34Z","snapshot_observed_at":"2026-08-17T01:59:36.560566Z","submitted_at":"2025-08-20T06:40:34Z","title":"DreamSwapV: Mask-guided Subject Swapping for Any Customized Video Editing","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T18:34:29.046999Z"},"links":{"cited_paper":"/paper/2506.10568","citing_paper":"/paper/2508.14465"},"observation_digest":"sha256:a5c14c0330ee14f413d2eb174b4b3d7673abf328b9c3663ba52eac6367007f7a","observation_id":"8bde6014-e75a-43cb-8617-589727365010","resolution":{"observed_at":"2026-08-05T18:34:29.046999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"cited_work":{"arxiv_id":"2506.10568","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.10568","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dreamactor-h1: High- fidelity human-product demonstration video generation via motion-designed diffusion transformers","venue":null,"work_id":"fc08b140-4f49-4f5a-aa23-0788d049694a","year":2025},"citing_paper":{"arxiv_id":"2601.10632","last_updated":"2026-04-10T16:10:59Z","snapshot_observed_at":"2026-08-16T20:35:09.241083Z","submitted_at":"2026-01-15T17:52:29Z","title":"CoMoVi: Co-Generation of 3D Human Motions and Realistic Videos","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-16T13:43:26.460480Z"},"links":{"cited_paper":"/paper/2506.10568","citing_paper":"/paper/2601.10632"},"observation_digest":"sha256:6578bc9cb662ce6a23583c0351b4129dd4230527433854c83641214b87a55d3b","observation_id":"0bcae23f-083b-4253-ae3b-ad0c7bbed159","resolution":{"observed_at":"2026-05-16T13:47:57.563792Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10568","snapshot_observed_at":"2026-08-03T00:16:31.611584Z","title":"Dreamactor-h1: High-fidelity human-product demonstration video generation via motion-designed diffusion transformers.arXiv preprint arXiv:2506.10568, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11117","last_updated":"2026-07-09T17:52:46Z","snapshot_observed_at":"2026-08-18T20:01:48.232361Z","submitted_at":"2026-02-11T18:31:47Z","title":"HairWeaver: Few-Shot Photorealistic Hair Motion Synthesis with Sim-to-Real Guided Video Diffusion","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T00:16:31.611584Z"},"links":{"cited_paper":"/paper/2506.10568","citing_paper":"/paper/2602.11117"},"observation_digest":"sha256:493d20a8330430d90cfb38b56532b6e23564434936c531a7439a5cef6dda498d","observation_id":"c99ec531-9f86-422b-b9a4-53809a87e143","resolution":{"observed_at":"2026-08-03T00:16:31.611584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10568","snapshot_observed_at":"2026-08-04T05:51:18.294240Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.14686","last_updated":"2026-08-01T10:55:14Z","snapshot_observed_at":"2026-08-13T20:45:11.827051Z","submitted_at":"2026-03-16T00:43:38Z","title":"MVHOI: Bridge Multi-view Condition to Complex Human-Object Interaction Video Reenactment via 3D Foundation Model","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:18.294240Z"},"links":{"cited_paper":"/paper/2506.10568","citing_paper":"/paper/2603.14686"},"observation_digest":"sha256:eed4fcc4b9ea2b2af1745d1b4f533a9aa694d2a52b5510c9920024c972360e59","observation_id":"be3e3eba-ad2f-4489-b69e-9ae609aadbb7","resolution":{"observed_at":"2026-08-04T05:51:18.294240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"cited_work":{"arxiv_id":"2506.10568","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.10568","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dreamactor-h1: High- fidelity human-product demonstration video generation via motion-designed diffusion transformers","venue":null,"work_id":"fc08b140-4f49-4f5a-aa23-0788d049694a","year":2025},"citing_paper":{"arxiv_id":"2604.11804","last_updated":"2026-04-17T08:08:09Z","snapshot_observed_at":"2026-08-06T16:53:42.723002Z","submitted_at":"2026-04-13T17:59:12Z","title":"OmniShow: Unifying Multimodal Conditions for Human-Object Interaction Video Generation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-10T15:09:02.727887Z"},"links":{"cited_paper":"/paper/2506.10568","citing_paper":"/paper/2604.11804"},"observation_digest":"sha256:d10fb94329f3d4b4ec5ef2ae1208ff3598a51a7cbe0559d438a3ca9ad5e6f6d1","observation_id":"f9652e81-3c17-4d91-bb19-dae390acd5be","resolution":{"observed_at":"2026-05-11T11:11:00.709409Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"cited_work":{"arxiv_id":"2506.10568","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.10568","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dreamactor-h1: High- fidelity human-product demonstration video generation via motion-designed diffusion transformers","venue":null,"work_id":"fc08b140-4f49-4f5a-aa23-0788d049694a","year":2025},"citing_paper":{"arxiv_id":"2604.19636","last_updated":"2026-04-21T16:25:43Z","snapshot_observed_at":"2026-08-15T00:39:55.994416Z","submitted_at":"2026-04-21T16:25:43Z","title":"CoInteract: Physically-Consistent Human-Object Interaction Video Synthesis via Spatially-Structured Co-Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-10T03:14:45.834520Z"},"links":{"cited_paper":"/paper/2506.10568","citing_paper":"/paper/2604.19636"},"observation_digest":"sha256:78bb20e463cf71151077f8e9131bc15a7a1fd5a53df53f409ed2d51bcac27d4b","observation_id":"aa34e54d-fba9-41a4-b2f2-ccdb3ee7ca64","resolution":{"observed_at":"2026-05-11T12:41:04.458730Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10568","snapshot_observed_at":"2026-08-01T15:42:24.969047Z","title":"Dreamactor-h1: High-fidelity human-product demonstration video generation via motion-designed diffusion transformers.arXiv preprint arXiv:2506.10568, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18217","last_updated":"2026-07-21T02:55:50Z","snapshot_observed_at":"2026-08-18T12:40:58.574283Z","submitted_at":"2026-07-20T17:51:35Z","title":"HOMIE: Human-object Centric Video Personalization via Multimodal Intelligent Enhancement","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-01T15:42:24.969047Z"},"links":{"cited_paper":"/paper/2506.10568","citing_paper":"/paper/2607.18217"},"observation_digest":"sha256:290c3f6a3222cbfbbb7d786629789c8dca6baa0d435f0bbe8d1d16d1b68b3952","observation_id":"ea7bc6e2-b739-4d5b-a685-6fc5cfe0a388","resolution":{"observed_at":"2026-08-01T15:42:24.969047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10568","snapshot_observed_at":"2026-08-01T10:37:55.196693Z","title":"Dreamactor-h1: High-fidelity human- product demonstration video generation via motion-designed dif- fusion transformers,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20174","last_updated":"2026-07-22T14:06:39Z","snapshot_observed_at":"2026-08-14T15:44:28.290456Z","submitted_at":"2026-07-22T14:06:39Z","title":"StreamHOI: Interaction-aware Temporal Memory Adaptation for Streaming HOI Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T10:37:55.196693Z"},"links":{"cited_paper":"/paper/2506.10568","citing_paper":"/paper/2607.20174"},"observation_digest":"sha256:15b0d57fc6147c1d978e13410749565fb658c672b028e7deda2b62848b7e66c2","observation_id":"30aa8ec6-bbaa-46e8-a672-15374d77a0b0","resolution":{"observed_at":"2026-08-01T10:37:55.196693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10568","snapshot_observed_at":"2026-08-01T05:27:19.302434Z","title":"Dreamactor-h1: High-fidelity human- product demonstration video generation via motion-designed diffusion transformers.arXiv preprint arXiv:2506.10568,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22241","last_updated":"2026-07-30T03:34:42Z","snapshot_observed_at":"2026-08-15T05:30:04.018365Z","submitted_at":"2026-07-24T12:17:57Z","title":"AgentHOI: Multi-Agent Reasoning for Human-Object-Interaction Video Generation via Implicit Representation Alignment","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-01T05:27:19.302434Z"},"links":{"cited_paper":"/paper/2506.10568","citing_paper":"/paper/2607.22241"},"observation_digest":"sha256:08f5de9559157a5357b75adeb476bea16a0b2c821c7620a50c69eb60a70bdfb8","observation_id":"dfc226ba-b4b7-4ef3-bb7d-5a4f24c8be4f","resolution":{"observed_at":"2026-08-01T05:27:19.302434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10568","snapshot_observed_at":"2026-07-30T20:31:40.443745Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:40.443745Z"},"links":{"cited_paper":"/paper/2506.10568","citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:beeac158de052e62d6e871d0e80634c19a13130c085bbd94312feabfbfa8cdd6","observation_id":"1eb057ca-a024-4d21-a2f5-a56dab73fdbe","resolution":{"observed_at":"2026-07-30T20:31:40.443745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.10568/citation-record","integrity":"/paper/2506.10568/integrity","json":"/paper/2506.10568/citation-record.json","paper":"/paper/2506.10568"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-20T09:39:07.545813Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-07T04:27:35.453661Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:35.453661Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:b65c1eb3976dd5a5898dc9ed9539a0a0c9788c16447d068d6368358e53dde27e","observation_id":"f7cf5117-865e-4185-8ac6-79caf126d91e","resolution":{"observed_at":"2026-08-07T04:27:35.453661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12052","last_updated":"2024-05-05T05:07:34Z","snapshot_observed_at":"2026-08-20T12:40:23.421319Z","submitted_at":"2023-11-18T10:22:44Z","title":"MagicPose: Realistic Human Poses and Facial Expressions Retargeting with Identity-aware Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12052","snapshot_observed_at":"2026-08-07T04:27:35.528292Z","title":"Magicpose: Realistic human poses and facial expressions retar- geting with identity-aware diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:35.528292Z"},"links":{"cited_paper":"/paper/2311.12052","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:b1f85e9b1d916a5f3d9d39ba2258b77acc1d1c861c9188ba1e1d328e26b3c634","observation_id":"95d0370b-4508-4694-b6d9-cb67eed28119","resolution":{"observed_at":"2026-08-07T04:27:35.528292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09985","last_updated":"2024-05-16T11:05:41Z","snapshot_observed_at":"2026-08-16T13:52:13.455334Z","submitted_at":"2024-05-16T11:05:41Z","title":"VirtualModel: Generating Object-ID-retentive Human-object Interaction Image by Diffusion Model for E-commerce Marketing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09985","snapshot_observed_at":"2026-08-07T04:27:35.651598Z","title":"Virtualmodel: Generating object-id-retentive human-object interac- tion image by diffusion model for e-commerce mar- keting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:35.651598Z"},"links":{"cited_paper":"/paper/2405.09985","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:408c50bd88046441dd7a9931484cf64313bd969820aa20d6f399c1093bf00e60","observation_id":"572bcc6b-60cb-4753-bc65-f0c0beda97a8","resolution":{"observed_at":"2026-08-07T04:27:35.651598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19707","last_updated":"2024-08-22T09:48:49Z","snapshot_observed_at":"2026-08-19T09:59:35.788967Z","submitted_at":"2024-05-30T05:36:12Z","title":"DeMamba: AI-Generated Video Detection on Million-Scale GenVideo Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19707","snapshot_observed_at":"2026-08-07T04:27:35.744160Z","title":"Demamba: Ai- generated video detection on million-scale genvideo benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:35.744160Z"},"links":{"cited_paper":"/paper/2405.19707","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:b1ee7027d32735199019645a721e866ea7eda02d69e8e205b50a010cb08ad6f8","observation_id":"d0c40586-5a76-4bad-9ac5-d04e2388cd2a","resolution":{"observed_at":"2026-08-07T04:27:35.744160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06187","last_updated":"2025-03-20T17:59:56Z","snapshot_observed_at":"2026-08-16T12:59:16.381164Z","submitted_at":"2025-01-10T18:59:54Z","title":"Multi-subject Open-set Personalization in Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06187","snapshot_observed_at":"2026-08-07T04:27:35.830106Z","title":"Multi-subject open-set per- sonalization in video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:35.830106Z"},"links":{"cited_paper":"/paper/2501.06187","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:cbede70d38dba318c77f0ed1cbe7461dc34819201a605a70ef0f82687c326ec3","observation_id":"aa3db6b1-61e1-4f0c-991e-e3d4180e669c","resolution":{"observed_at":"2026-08-07T04:27:35.830106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:35.941147Z","title":"Arcface: Additive angular margin loss for deep face recognition","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:35.941147Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:afcad75d308adf87a01879df37aae01bf422442c922cb1a25853c84fc1d279e0","observation_id":"b7b1b7bb-7953-46b0-bfce-c271fda3d99e","resolution":{"observed_at":"2026-08-07T04:27:35.941147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10391","last_updated":"2025-03-13T14:07:58Z","snapshot_observed_at":"2026-08-16T12:50:22.094509Z","submitted_at":"2025-03-13T14:07:58Z","title":"CINEMA: Coherent Multi-Subject Video Generation via MLLM-Based Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10391","snapshot_observed_at":"2026-08-07T04:27:36.010543Z","title":"Cinema: Coherent multi-subject video generation via mllm- based guidance","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:36.010543Z"},"links":{"cited_paper":"/paper/2503.10391","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:eb542c86180c081427da24ae8e69493515bff9558a63fe2cb2bf87c5d8d6c56a","observation_id":"aa4e6714-16c5-4dc3-9c33-4edf724954cd","resolution":{"observed_at":"2026-08-07T04:27:36.010543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.627929Z","title":"Cg-hoi: Contact- guided 3d human-object interaction generation","venue":null,"work_id":"6ba25581-3377-4d76-84c8-fa693e90a8df","year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:36.078577Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:b33112274e50a86533192abc1d307cafffa04dc44febba85d07b846c24f5524d","observation_id":"141b31cb-bab1-411e-9fda-f605c67e8c64","resolution":{"observed_at":"2026-08-07T04:27:40.631707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.618823Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":"7ce72a23-d681-4c92-bd8f-b2ac6afdac85","year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:36.221249Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:a26a00e459e7edbd09a306c4236e9f2d0130c611020f07b2a0703a9037776b4d","observation_id":"32afd132-216f-4a9e-bb05-015e607f768f","resolution":{"observed_at":"2026-08-07T04:27:40.622031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.610171Z","title":"Re-hold: Video hand object interaction reenactment via adaptive layout-instructed diffusion model","venue":null,"work_id":"0ad29cda-09c6-4738-843f-f089105f4eac","year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:36.304095Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:65348024d5156b6f44d11ba61359561031b622e68b5602ce9c9838603adc9a56","observation_id":"6dff5e41-fb66-488e-b8eb-8eb5a7e97f03","resolution":{"observed_at":"2026-08-07T04:27:40.613189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04847","last_updated":"2025-08-04T07:36:34Z","snapshot_observed_at":"2026-08-15T05:59:56.592267Z","submitted_at":"2025-02-07T11:36:36Z","title":"HumanDiT: Pose-Guided Diffusion Transformer for Long-form Human Motion Video Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04847","snapshot_observed_at":"2026-08-07T04:27:36.393512Z","title":"Humandit: Pose-guided diffusion transformer for long-form human motion video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:36.393512Z"},"links":{"cited_paper":"/paper/2502.04847","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:65a702edc92cdd8bba30ae1bed677f81cbc9a6f93a469990d79920fb39e988d6","observation_id":"07cca7ad-aab0-4be6-895e-9914d2213c04","resolution":{"observed_at":"2026-08-07T04:27:36.393512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11346","last_updated":"2025-06-28T11:46:35Z","snapshot_observed_at":"2026-08-20T09:46:38.792377Z","submitted_at":"2025-04-15T16:19:07Z","title":"Seedream 3.0 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11346","snapshot_observed_at":"2026-08-07T04:27:36.480842Z","title":"Seedream 3.0 techni- cal report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:36.480842Z"},"links":{"cited_paper":"/paper/2504.11346","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:212ed3e5a48c2e4d5529d61c6aaa0a0575e4c11dd2f9b9179df37b2cc677b1d4","observation_id":"3d323f8a-3d47-401a-b86a-8c5b782a6673","resolution":{"observed_at":"2026-08-07T04:27:36.480842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.601129Z","title":"Imos: Intent-driven full-body motion synthesis for human- object interactions","venue":null,"work_id":"b69301eb-b6f3-4446-a7b1-3df06276adb1","year":2023},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:36.587817Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:a455def30911794369f6760d364ee0b38619d1f815b238da9e1ee0014fae0062","observation_id":"efaf775b-1a6a-4091-a27b-735c21c3f170","resolution":{"observed_at":"2026-08-07T04:27:40.604476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.592602Z","title":"Hu- mans in 4d: Reconstructing and tracking humans with transformers","venue":null,"work_id":"253128f6-b8e6-43dc-bf8a-c3b588031dc6","year":2023},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:36.658136Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:542ddf2a06cc0c011899d1b142a26af9d2964a33fdbd43423cb034bd5a0f6989","observation_id":"aea036b4-cd63-41d6-af72-20d37307f84b","resolution":{"observed_at":"2026-08-07T04:27:40.595536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.583924Z","title":"Talk-act: Enhance textural-awareness for 2d speaking avatar reenactment with diffusion model","venue":null,"work_id":"44c65b8f-61b2-4263-81d5-e08948871b5c","year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:36.725524Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:69a315f320ce01f96577c1b6be4a3ace38c1065b0ffe72c2300ce8229eb69302","observation_id":"bc3f6931-458f-4bbb-b053-d4b43420478d","resolution":{"observed_at":"2026-08-07T04:27:40.587012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.574745Z","title":null,"venue":null,"work_id":"2ef6a032-4dfe-4091-a87f-0cd57ddc6b8d","year":2021},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:36.830468Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:5a022fa4c31f733a2e49701733fcabac7881f827cc38c88e123dbb27ecffa5b7","observation_id":"d4b5b45c-aae9-433e-9eca-97b1cc7bfbfe","resolution":{"observed_at":"2026-08-07T04:27:40.577674Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.565542Z","title":"Synthesizing physical character-scene interactions","venue":null,"work_id":"8cd93ff8-94f0-41f9-b8c1-7c3a1067f8b2","year":2023},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:36.919945Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:b6705eb24fb8bdebc8305eb2388e4fb3f590284f99ec77f89b02ec4f1129249d","observation_id":"45921784-8017-4d10-8c24-dc7ea3775849","resolution":{"observed_at":"2026-08-07T04:27:40.568839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15275","last_updated":"2024-06-25T16:57:27Z","snapshot_observed_at":"2026-08-16T13:58:25.984156Z","submitted_at":"2024-04-23T17:59:43Z","title":"ID-Animator: Zero-Shot Identity-Preserving Human Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15275","snapshot_observed_at":"2026-08-07T04:27:37.011985Z","title":"Id- animator: Zero-shot identity-preserving human video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:37.011985Z"},"links":{"cited_paper":"/paper/2404.15275","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:de547f991a244feac6135044f2a3b78f1d0998e89786d8a109d0711274a92eb4","observation_id":"b0b5dec7-2936-4512-a09e-1ee5b11f441c","resolution":{"observed_at":"2026-08-07T04:27:37.011985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.555477Z","title":"Interactdiffusion: Inter- action control in text-to-image diffusion models","venue":null,"work_id":"4e0947e8-d869-4b6a-aa90-b3858eab2643","year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:37.085163Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:6efe5b458dbd5cdde7b8f59f1e79d01bb63e52aca326ba861f15b7430d9c8b4a","observation_id":"43497b0a-08c2-4b0d-b696-f25d9735062a","resolution":{"observed_at":"2026-08-07T04:27:40.559249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.546286Z","title":"Hand-object interaction image gener- ation","venue":null,"work_id":"48427772-b687-4231-836c-b1b58459fea6","year":2022},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:37.190823Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:389b4b33b875d9b4db8132e280b4fb4eef9ca35da15aed4982a8f98f7b952eb1","observation_id":"953d7c58-2c32-4c26-946f-c757178c5b30","resolution":{"observed_at":"2026-08-07T04:27:40.549300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.537219Z","title":"Animate anyone: Consistent and controllable image-to-video synthesis for character animation","venue":null,"work_id":"8d543dca-5046-4136-92fb-20a714c9f976","year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:37.234184Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:af976fdb82b15e08227b8496c58a277edf79b477f1178536657927091a569eb5","observation_id":"166d2e6f-2e59-4529-b71b-f7a080078085","resolution":{"observed_at":"2026-08-07T04:27:40.540378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-14T23:19:43.982858Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-08-07T04:27:37.301689Z","title":"Animate anyone 2: High-fidelity character image animation with environment affor- dance","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:37.301689Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:15e201ba2cdca9c5b6ac4696b64c85095e745bdff04e7e60b8da05cbf7215312","observation_id":"40521004-e0ea-4765-9525-e717f7b67f2b","resolution":{"observed_at":"2026-08-07T04:27:37.301689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04512","last_updated":"2025-05-08T08:29:00Z","snapshot_observed_at":"2026-08-18T10:31:16.201312Z","submitted_at":"2025-05-07T15:33:18Z","title":"HunyuanCustom: A Multimodal-Driven Architecture for Customized Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04512","snapshot_observed_at":"2026-08-07T04:27:37.363932Z","title":"Hunyuancus- tom: A multimodal-driven architecture for customized video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:37.363932Z"},"links":{"cited_paper":"/paper/2505.04512","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:c4fef0873dae6ce92110e983eb791cf9d4f6f3f2fa8a219c855f92b6a13ed867","observation_id":"074be566-ef03-4cca-86e2-8188ae16870a","resolution":{"observed_at":"2026-08-07T04:27:37.363932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19415","last_updated":"2025-05-03T00:42:46Z","snapshot_observed_at":"2026-08-17T23:23:51.821812Z","submitted_at":"2024-11-28T23:45:45Z","title":"AMO Sampler: Enhancing Text Rendering with Overshooting","version":2},"cited_work":{"arxiv_id":"2411.19415","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.19415","snapshot_observed_at":"2026-08-07T04:27:40.159007Z","title":"AMO Sampler: Enhancing Text Rendering with Overshooting","venue":"cs.CV","work_id":"06395a20-6835-44d0-bbfb-b91806c7b07c","year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:37.476628Z"},"links":{"cited_paper":"/paper/2411.19415","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:7d73cd01961cd7e665718748811aac42f23b0c9b05bbc155f3e93c16eb1e9527","observation_id":"41dcc4fd-8083-49cb-b17e-e8b3d41755c6","resolution":{"observed_at":"2026-08-07T04:27:40.162486Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05823","last_updated":"2025-01-10T10:01:36Z","snapshot_observed_at":"2026-08-16T12:59:21.418713Z","submitted_at":"2025-01-10T10:01:36Z","title":"PersonaHOI: Effortlessly Improving Personalized Face with Human-Object Interaction Generation","version":1},"cited_work":{"arxiv_id":"2501.05823","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.05823","snapshot_observed_at":"2026-08-07T04:27:40.145373Z","title":"PersonaHOI: Effortlessly Improving Personalized Face with Human-Object Interaction Generation","venue":"cs.CV","work_id":"0fd060a1-868a-44c5-921c-a1ccf36e3ffc","year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:37.560155Z"},"links":{"cited_paper":"/paper/2501.05823","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:51f39fab736024af5ceafde2bd42084d33489d5f94db72973f64bba53867dcf2","observation_id":"bc540a49-1d26-46b4-bd49-8b5e8e24b26d","resolution":{"observed_at":"2026-08-07T04:27:40.148708Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21781","last_updated":"2025-03-27T17:59:58Z","snapshot_observed_at":"2026-08-16T12:46:11.517508Z","submitted_at":"2025-03-27T17:59:58Z","title":"VideoMage: Multi-Subject and Motion Customization of Text-to-Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21781","snapshot_observed_at":"2026-08-07T04:27:37.609012Z","title":"Videomage: Multi-subject and motion cus- tomization of text-to-video diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:37.609012Z"},"links":{"cited_paper":"/paper/2503.21781","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:3cb2e862edb15dab333d3388a00b56cba9bcdd1f607cdf169ba7124fb6c9765a","observation_id":"f6275bdd-f85e-4017-abce-03e5a57b09c1","resolution":{"observed_at":"2026-08-07T04:27:37.609012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.527973Z","title":"Hoigpt: Learning long se- quence hand-object interaction with language models","venue":null,"work_id":"e0a359e2-744a-4faa-9c50-c6e2f6c06026","year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:37.675446Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:5e81321a23753255c298f1832b0e77168cb9c8051e0e4cedd44048312771c67f","observation_id":"e7f36d88-1a0e-4b8f-a4fc-da5fec85c6cb","resolution":{"observed_at":"2026-08-07T04:27:40.530914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04698","last_updated":"2025-05-13T06:42:52Z","snapshot_observed_at":"2026-08-10T21:24:08.597398Z","submitted_at":"2025-01-08T18:59:01Z","title":"ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04698","snapshot_observed_at":"2026-08-07T04:27:37.785167Z","title":"Conceptmaster: Multi- concept video customization on diffusion transformer models without test-time tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:37.785167Z"},"links":{"cited_paper":"/paper/2501.04698","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:29a8fe593ef8ece59f8990431d2282af25f4967cc2ca8354443e36031d759d79","observation_id":"b6a00451-3efa-4c79-b637-4fe082db90d5","resolution":{"observed_at":"2026-08-07T04:27:37.785167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.518262Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":"a0a6d713-0c28-4c33-a677-a17fc3acfd54","year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:37.833532Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:3b564612640c94036101d6021a6549924bb4f6fcc5a77dd1a10defac64e7a179","observation_id":"fb79d313-8b6e-48dd-935e-15c72e6759df","resolution":{"observed_at":"2026-08-07T04:27:40.521342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.508949Z","title":"Make-your- anchor: A diffusion-based 2d avatar generation frame- work","venue":null,"work_id":"9b341cf5-ff66-4e75-8cf7-9028b250971b","year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:37.943192Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:0e81fe5e278183d9b10615e07fb41df6c8150dba70aac6e2bfea61ac2df9fa3a","observation_id":"94ff7ac2-a1ef-466f-b595-dd0a0d10aab4","resolution":{"observed_at":"2026-08-07T04:27:40.512253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.500346Z","title":"Videobooth: Diffusion-based video generation with image prompts","venue":null,"work_id":"adb08a41-a57f-41f6-9b83-e3a0c425580a","year":2023},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:38.033968Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:eba624fd2f5213e06ecfdfa32ff1e3f7bad89d9c0b82bf435ab015fa539e331e","observation_id":"77a67668-4b2e-4c63-8c72-fa071a1f3d04","resolution":{"observed_at":"2026-08-07T04:27:40.503170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07598","last_updated":"2025-03-11T06:44:25Z","snapshot_observed_at":"2026-07-06T20:50:05.070886Z","submitted_at":"2025-03-10T17:57:04Z","title":"VACE: All-in-One Video Creation and Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07598","snapshot_observed_at":"2026-08-07T04:27:38.050454Z","title":"Vace: All-in- one video creation and editing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:38.050454Z"},"links":{"cited_paper":"/paper/2503.07598","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:2ea2c36a54fb038e1780651fa4796993a573c92376f7595b82f249ad9d65c99e","observation_id":"276c3eca-7e9d-487e-991d-c233f0189f61","resolution":{"observed_at":"2026-08-07T04:27:38.050454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.491473Z","title":"Dreampose: Fashion image-to-video synthesis via stable diffu- sion","venue":null,"work_id":"b4e0848a-3d57-4027-9fc7-21a000b88e01","year":2023},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:38.155846Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:413f9958f64b1ecd995ee354a89a33b4ec286223b4df8e3568f1687eca85c5ce","observation_id":"65c2ddc7-865a-42a7-9182-8409f303626b","resolution":{"observed_at":"2026-08-07T04:27:40.494416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17816","last_updated":"2026-05-05T15:27:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-23T06:48:31Z","title":"Learning Zero-Shot Subject-Driven Video Generation Using 1% Compute","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17816","snapshot_observed_at":"2026-08-07T04:27:38.238543Z","title":"Subject- driven video generation via disentangled identity and motion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:38.238543Z"},"links":{"cited_paper":"/paper/2504.17816","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:acc95a078fc0d6438e7a853a7a29773a89b943d2a36489039868e896da83a324","observation_id":"f56c5942-507e-4058-8ec1-db9dd425f714","resolution":{"observed_at":"2026-08-07T04:27:38.238543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.482385Z","title":"Auto- encoding variational bayes, 2013","venue":null,"work_id":"53fbc348-0a3f-41ac-abee-20a4d49dc5f8","year":2013},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:38.362515Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:8f0e54bb83573f8b9bb4dda752dfefdd3a99f02e0880731a29f307ccfb46fea4","observation_id":"e9686645-ea88-4a3a-8725-f48c6839acef","resolution":{"observed_at":"2026-08-07T04:27:40.485413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09349","last_updated":"2025-02-25T02:55:40Z","snapshot_observed_at":"2026-08-16T13:00:09.977872Z","submitted_at":"2024-12-12T15:15:59Z","title":"DisPose: Disentangling Pose Guidance for Controllable Human Image Animation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09349","snapshot_observed_at":"2026-08-07T04:27:38.459797Z","title":"Dispose: Disentangling pose guidance for controllable human image animation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:38.459797Z"},"links":{"cited_paper":"/paper/2412.09349","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:826a53ed33ae978bb6910ecf37b838d77b03498bfcf9405c3baa6b33db76c518","observation_id":"5de61e95-d7f2-494f-9ea7-e719d2ea0667","resolution":{"observed_at":"2026-08-07T04:27:38.459797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.473715Z","title":"Object motion guided human motion synthesis","venue":null,"work_id":"0c692326-0939-4407-b6ed-6de2cbb31b64","year":2023},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:38.515400Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:d9fc35bdd5f48265d7924543cbd67abd5f95d69c071a926f37a0b7c7f5ddd3e9","observation_id":"bbeed35b-9cb9-4f67-8602-b6736979d5a3","resolution":{"observed_at":"2026-08-07T04:27:40.476746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07802","last_updated":"2025-02-04T22:03:26Z","snapshot_observed_at":"2026-08-18T19:17:49.294065Z","submitted_at":"2025-02-04T22:03:26Z","title":"Movie Weaver: Tuning-Free Multi-Concept Video Personalization with Anchored Prompts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07802","snapshot_observed_at":"2026-08-07T04:27:38.640647Z","title":"Movie weaver: Tuning-free multi-concept video personalization with anchored prompts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:38.640647Z"},"links":{"cited_paper":"/paper/2502.07802","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:0e37f8997278ce642098eea11198f118c7e613b7f3aee33038f24471e5b93a94","observation_id":"0eb41898-8410-49d4-92ae-de29a9b67915","resolution":{"observed_at":"2026-08-07T04:27:38.640647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01061","last_updated":"2025-06-30T08:26:56Z","snapshot_observed_at":"2026-08-20T06:05:18.569195Z","submitted_at":"2025-02-03T05:17:32Z","title":"OmniHuman-1: Rethinking the Scaling-Up of One-Stage Conditioned Human Animation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01061","snapshot_observed_at":"2026-08-07T04:27:38.740409Z","title":"Omnihuman-1: Rethinking the scaling-up of one-stage conditioned human animation models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:38.740409Z"},"links":{"cited_paper":"/paper/2502.01061","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:84dd5aef289faa705600e7746ed7980395ed36dbea2333995e6123a9a5935b04","observation_id":"999fc872-0aa8-460f-a1d6-35f716de3a2b","resolution":{"observed_at":"2026-08-07T04:27:38.740409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-16T02:30:42.660030Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-07T04:27:38.861050Z","title":"Flow match- ing for generative modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:38.861050Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:489265a0c69dd6b68b83e11f16a88d997076f2d8ee84b21837e65da13aae0915","observation_id":"64d67499-11a0-4d8d-a75c-b84a26fa6fe5","resolution":{"observed_at":"2026-08-07T04:27:38.861050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.465406Z","title":"Hoigen- 1m: A large-scale dataset for human-object interaction video generation","venue":null,"work_id":"b72e3a5c-8348-4c46-93cb-f1d1c3174528","year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:38.951131Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:7f5f3a5cd6a7791d05cfe2916e7784c4b9115b8f8242c2247000cfa8c27680f8","observation_id":"b2a37fb8-05b7-4680-8c2f-a140739b0199","resolution":{"observed_at":"2026-08-07T04:27:40.468300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11079","last_updated":"2025-04-10T10:24:37Z","snapshot_observed_at":"2026-08-16T12:58:02.352853Z","submitted_at":"2025-02-16T11:02:50Z","title":"Phantom: Subject-consistent video generation via cross-modal alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11079","snapshot_observed_at":"2026-08-07T04:27:39.046915Z","title":"Phan- tom: Subject-consistent video generation via cross- modal alignment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.046915Z"},"links":{"cited_paper":"/paper/2502.11079","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:f3ca205c1b71f3364861e753e6810c02e8f8a6d117fb6fb96c6cf1e516c48e49","observation_id":"762ce83a-a2b1-4b2b-b0d3-7452fde4b615","resolution":{"observed_at":"2026-08-07T04:27:39.046915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.456588Z","title":"Grounding dino: Marry- ing dino with grounded pre-training for open-set ob- ject detection","venue":null,"work_id":"8961870b-1f2b-4e06-a7d9-69014f23db15","year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.150225Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:509a17df6c5dfdddbae79d65f5e041d9f8c3c52e4970ea55fc51e60bd8aba419","observation_id":"1823a2e1-8249-4e03-8df9-4d79a1c00f0d","resolution":{"observed_at":"2026-08-07T04:27:40.459428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:39.298004Z","title":"Easyhoi: Unleashing the power of large models for reconstructing hand-object interac- tions in the wild","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.298004Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:ebca69f041087004c62b0ccb503127bf4c6fde6509865669c485d63801f3ab3b","observation_id":"cb579a2e-ba61-44e1-8d11-d7f453e9bc28","resolution":{"observed_at":"2026-08-07T04:27:39.298004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01724","last_updated":"2025-04-20T11:52:01Z","snapshot_observed_at":"2026-08-16T12:44:36.246043Z","submitted_at":"2025-04-02T13:30:32Z","title":"DreamActor-M1: Holistic, Expressive and Robust Human Image Animation with Hybrid Guidance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01724","snapshot_observed_at":"2026-08-07T04:27:39.414486Z","title":"Dreamactor- m1: Holistic, expressive and robust human image animation with hybrid guidance","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.414486Z"},"links":{"cited_paper":"/paper/2504.01724","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:78a5e939748f036d07afb0028624270af8b8cf5662326608bc115adbe42955e7","observation_id":"944986a0-8c64-4f18-b03e-26546099d902","resolution":{"observed_at":"2026-08-07T04:27:39.414486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.447292Z","title":"Follow your pose: Pose-guided text-to-video generation using pose-free videos","venue":null,"work_id":"f5db42a3-9844-45d9-bd8f-7d7915322133","year":null},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.482588Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:9bea1b18f430337328eaf1b139742b6475b74098a68f3ae9f93f52ed7c06bc5b","observation_id":"e2758575-8a44-4bda-ad81-69292e742819","resolution":{"observed_at":"2026-08-07T04:27:40.450432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16160","last_updated":"2025-06-11T08:28:01Z","snapshot_observed_at":"2026-08-16T13:58:12.955222Z","submitted_at":"2024-09-24T15:00:07Z","title":"MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16160","snapshot_observed_at":"2026-08-07T04:27:39.630656Z","title":"Mimo: Controllable character video synthesis with spatial decomposed modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.630656Z"},"links":{"cited_paper":"/paper/2409.16160","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:4080bba8a411c2a23a6d59bfb8d96be8d90d5cbee5cf6d3df3b08578cf501754","observation_id":"eb3a1901-2bf6-4197-b46f-a3a5fff9545e","resolution":{"observed_at":"2026-08-07T04:27:39.630656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.438090Z","title":null,"venue":null,"work_id":"609a396c-3c32-4a79-a428-72afef6bb0c3","year":2023},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.634868Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:cfe40ad7b844e27963dfd3504b70ded8282cbb7bf02488b1f6712995a24b7583","observation_id":"a4c6622c-f55b-4816-9c56-9fc178f67f2b","resolution":{"observed_at":"2026-08-07T04:27:40.441006Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.428659Z","title":null,"venue":null,"work_id":"c40867cb-9380-4ac1-9bb8-73422744821b","year":2019},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.638116Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:f59761cfff5b1b9fe89b577b434f10398a6a59b6e41e5ab4a6f0f93a3cc4cba1","observation_id":"fd648301-a875-493d-95d0-73574715754e","resolution":{"observed_at":"2026-08-07T04:27:40.431478Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.419924Z","title":"Reconstructing hands in 3D with transformers","venue":null,"work_id":"f2990fe7-de7e-4121-bc06-b3217ddd9010","year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.641462Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:49bef6ef14467613bdfcf34deb63586e872c0b51002a0b604cf68b4513fe69aa","observation_id":"3ec9bac1-98ca-4609-8157-d9d68456cf52","resolution":{"observed_at":"2026-08-07T04:27:40.422863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.410709Z","title":"Scalable diffu- sion models with transformers","venue":null,"work_id":"55f714dc-2f27-4a6c-98bd-41551cb1723c","year":2023},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.644798Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:66dff931a8f2b406651de3933f7e733574e26a13cbc5c8e4ee1edd8ab9e7fe6a","observation_id":"c45b8ec5-9d73-4c08-84bd-8bf0eec7067e","resolution":{"observed_at":"2026-08-07T04:27:40.413857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06070","last_updated":"2025-03-08T08:43:03Z","snapshot_observed_at":"2026-08-19T14:04:38.615117Z","submitted_at":"2024-08-12T11:41:18Z","title":"ControlNeXt: Powerful and Efficient Control for Image and Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06070","snapshot_observed_at":"2026-08-07T04:27:39.647955Z","title":"Controlnext: Pow- erful and efficient control for image and video gener- ation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.647955Z"},"links":{"cited_paper":"/paper/2408.06070","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:a8e69a22fa58872aedf6f8ec5d27139b2a3c7924da35aea57cd1fb092383f908","observation_id":"0f5c3aa7-9e28-4f2c-af4f-db2570905d6f","resolution":{"observed_at":"2026-08-07T04:27:39.647955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06553","last_updated":"2025-07-07T05:09:32Z","snapshot_observed_at":"2026-08-20T10:40:30.650361Z","submitted_at":"2023-12-11T17:41:17Z","title":"HOI-Diff: Text-Driven Synthesis of 3D Human-Object Interactions using Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06553","snapshot_observed_at":"2026-08-07T04:27:39.652056Z","title":"Hoi-diff: Text- driven synthesis of 3d human-object interactions using diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.652056Z"},"links":{"cited_paper":"/paper/2312.06553","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:27abc4f9080335be7a3c5c6a1ab82568b0715f524e8cc3e4d4747ccfca813cd3","observation_id":"aa288ba1-566b-4548-b58f-0968803808ee","resolution":{"observed_at":"2026-08-07T04:27:39.652056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.401880Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"ba5802ca-ddc8-435f-8312-2b6140c91a34","year":2021},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.655262Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:4c6ebb6db19d6328098b2098a6c7501b58404dd78e681b77626221263b8caa41","observation_id":"ef56d7f6-ee98-4c40-aa24-ceb0366dace8","resolution":{"observed_at":"2026-08-07T04:27:40.404898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-07T04:27:39.658454Z","title":"Sam 2: Segment anything in images and videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.658454Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:24e27cbddc72fd1c52482c26cfdc5fba6c277d64f088c9e66fc82e524bcbde83","observation_id":"71f9ce5d-75fa-40f9-9607-44a39d897dae","resolution":{"observed_at":"2026-08-07T04:27:39.658454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08685","last_updated":"2025-05-05T03:31:30Z","snapshot_observed_at":"2026-08-16T12:41:57.140222Z","submitted_at":"2025-04-11T16:46:20Z","title":"Seaweed-7B: Cost-Effective Training of Video Generation Foundation Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08685","snapshot_observed_at":"2026-08-07T04:27:39.661697Z","title":"Seaweed-7b: Cost-effective training of video generation foundation model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.661697Z"},"links":{"cited_paper":"/paper/2504.08685","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:6af76d69133e0da4815a89a4afc021f251ebf50d1a9eef0852d19b52a31d6e1d","observation_id":"6c6a5139-5358-4ad9-8aec-a5f68a36709a","resolution":{"observed_at":"2026-08-07T04:27:39.661697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07062","last_updated":"2025-05-11T17:28:30Z","snapshot_observed_at":"2026-08-20T20:37:36.775968Z","submitted_at":"2025-05-11T17:28:30Z","title":"Seed1.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07062","snapshot_observed_at":"2026-08-07T04:27:39.665617Z","title":"Seed1.5-vl technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.665617Z"},"links":{"cited_paper":"/paper/2505.07062","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:dcf9010795539dd27dc5047b4176373c464932bd3562050238938e782a8a82cf","observation_id":"b0e77c38-bd66-4c1c-afe5-753e6bd1b3bb","resolution":{"observed_at":"2026-08-07T04:27:39.665617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17697","last_updated":"2024-11-27T07:39:20Z","snapshot_observed_at":"2026-08-15T07:21:59.072249Z","submitted_at":"2024-11-26T18:59:22Z","title":"StableAnimator: High-Quality Identity-Preserving Human Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17697","snapshot_observed_at":"2026-08-07T04:27:39.669220Z","title":"Stableanimator: High-quality identity-preserving human image anima- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.669220Z"},"links":{"cited_paper":"/paper/2411.17697","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:574b5284e44617d189597e070dbe1c56c02b89fc9428c5a5a0098b353ecd68af","observation_id":"ebbf65d4-ddb6-4f1e-b73d-f9404f9751e8","resolution":{"observed_at":"2026-08-07T04:27:39.669220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-07T04:27:39.672759Z","title":"Wan: Open and advanced large-scale video generative models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.672759Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:a1cab698c9559879c3672d66c981e21dbe89feb92b6b6c3169c06d0b279fc463","observation_id":"60231ff3-e4b3-41f7-99b0-97da389e5e76","resolution":{"observed_at":"2026-08-07T04:27:39.672759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.392433Z","title":"Faceverse: a fine-grained and detail-controllable 3d face morphable model from a hybrid dataset","venue":null,"work_id":"5c0e077a-fed0-45fd-a5e8-fb58d7b91412","year":2022},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.676102Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:203a05b64b63433243b4d31280697bc205d1b150469414359df6806a5f6df5fe","observation_id":"a95f083c-ad7c-4a9e-bf7c-64d4d2fbb25e","resolution":{"observed_at":"2026-08-07T04:27:40.395898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.383599Z","title":"Disco: Disentan- gled control for realistic human dance generation","venue":null,"work_id":"e42ab6d4-44b9-402d-b217-1c36199c024b","year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.679551Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:3b2837d00b4492fe41a2f7d81907f21c012463a7818bc455686798dc43e48b13","observation_id":"f2a8e295-3270-4686-8107-e17675f119d7","resolution":{"observed_at":"2026-08-07T04:27:40.386376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01188","last_updated":"2024-06-03T10:51:10Z","snapshot_observed_at":"2026-08-18T22:36:33.661827Z","submitted_at":"2024-06-03T10:51:10Z","title":"UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01188","snapshot_observed_at":"2026-08-07T04:27:39.682433Z","title":"Unianimate: Taming unified video diffusion models for consistent human image anima- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.682433Z"},"links":{"cited_paper":"/paper/2406.01188","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:94615bc8921b4a4c1f299ab199ce6ddafebeac2f5e1a7415729b0f9cd39deefe","observation_id":"4405de39-156f-4553-aba1-b083bfc1f32e","resolution":{"observed_at":"2026-08-07T04:27:39.682433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.375461Z","title":"Dreamvideo: Composing your dream videos with customized subject and motion","venue":null,"work_id":"38ef3aa4-ed35-42a7-877e-cc1b38853925","year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.685482Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:c0c5b16d275f3b41a61acb60ef970e160843a1bcbf14ae535c20ffb02cf50820","observation_id":"3251c372-50e7-4229-8020-d329246c0c56","resolution":{"observed_at":"2026-08-07T04:27:40.378384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.366768Z","title":"InterDiff: Generating 3d human-object in- teractions with physics-informed diffusion","venue":null,"work_id":"cc6bd56f-73d4-48c3-8310-01689b219e71","year":null},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.688905Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:369cac7445364e37b03fd93f6e5a790617d6421ab0cc898a6ffe55c839e229b6","observation_id":"5c33c9e9-769d-4937-a09d-64e119d7a281","resolution":{"observed_at":"2026-08-07T04:27:40.369961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.357077Z","title":"Intermimic: Towards universal whole- body control for physics-based human-object interac- tions","venue":null,"work_id":"757720c9-fffd-4c82-b500-08e7070589c6","year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.692263Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:1df154e8b7574697739493e980eba72bfadf2d4418dad85d822b63116a919e94","observation_id":"d34ae1c1-fb55-4c8c-8345-1293410594d6","resolution":{"observed_at":"2026-08-07T04:27:40.360682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17383","last_updated":"2025-06-23T06:27:21Z","snapshot_observed_at":"2026-08-16T09:32:44.099692Z","submitted_at":"2024-11-26T12:42:13Z","title":"AnchorCrafter: Animate Cyber-Anchors Selling Your Products via Human-Object Interacting Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17383","snapshot_observed_at":"2026-08-07T04:27:39.696090Z","title":"Anchorcrafter: Ani- mate cyber-anchors selling your products via human- object interacting video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.696090Z"},"links":{"cited_paper":"/paper/2411.17383","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:81e7395a739a45c2a43f8396a08f879ecab2f8b4a9d3764efb57afd05c08c02c","observation_id":"7695aa6e-649e-4d48-850d-d5b6ee71c305","resolution":{"observed_at":"2026-08-07T04:27:39.696090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.347334Z","title":"Magicanimate: Temporally con- sistent human image animation using diffusion model","venue":null,"work_id":"4ecf6b72-eadc-4e52-9fe2-87d970677ac0","year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.699182Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:99fd1cb45f06ff33538c08b0fee72674261d6730bbdb30a9a8ae85c8f04a5994","observation_id":"aa2f2ea6-dc0d-4c02-83c1-64f4d2ca5ca3","resolution":{"observed_at":"2026-08-07T04:27:40.350372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07754","last_updated":"2024-11-08T21:35:16Z","snapshot_observed_at":"2026-08-16T13:43:58.702932Z","submitted_at":"2024-06-11T22:31:29Z","title":"HOI-Swap: Swapping Objects in Videos with Hand-Object Interaction Awareness","version":2},"cited_work":{"arxiv_id":"2406.07754","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.07754","snapshot_observed_at":"2026-08-07T04:27:39.829819Z","title":"HOI-Swap: Swapping Objects in Videos with Hand-Object Interaction Awareness","venue":"cs.CV","work_id":"8f7a28b7-b49a-4869-a442-a67235124892","year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.701947Z"},"links":{"cited_paper":"/paper/2406.07754","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:c897180b8ae5b79c288b675f6a1d97efedf5f95af44e274486da35d91676e5cb","observation_id":"6402a8d9-1859-411e-9b04-c696aa1e24ab","resolution":{"observed_at":"2026-08-07T04:27:39.836453Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.338119Z","title":"Diffusion-guided reconstruction of ev- eryday hand-object interaction clips","venue":null,"work_id":"f03534a4-21ec-4429-8424-9b7c6b0a1686","year":2023},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.705011Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:a5b7cb9725955786fe1e6d8c039caeec1cdde17cd18a82b66de74a4c634e3d39","observation_id":"f9f9785b-5333-4420-90ec-45f9e604ba68","resolution":{"observed_at":"2026-08-07T04:27:40.341375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.328729Z","title":"Affordance diffusion: Synthesiz- ing hand-object interactions","venue":null,"work_id":"c0308423-f286-4a5b-8853-27a2ef2c351d","year":2023},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.708199Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:35a641321e3ffdfca3637063987567d5aab27fbb930b90939deae97b419aaf1e","observation_id":"525975d6-dbef-4eec-85de-5085d9f34d8c","resolution":{"observed_at":"2026-08-07T04:27:40.331913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17440","last_updated":"2025-03-25T23:08:48Z","snapshot_observed_at":"2026-08-15T17:17:11.643992Z","submitted_at":"2024-11-26T13:58:24Z","title":"Identity-Preserving Text-to-Video Generation by Frequency Decomposition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17440","snapshot_observed_at":"2026-08-07T04:27:39.711058Z","title":"Identity-preserving text-to-video genera- tion by frequency decomposition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.711058Z"},"links":{"cited_paper":"/paper/2411.17440","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:afbc30a4182ab6c3a1416e297fcdd74f14aea25e4d449b0f25a227ee69cc97fe","observation_id":"241d36e5-0297-4afd-97b0-cd103d00fd43","resolution":{"observed_at":"2026-08-07T04:27:39.711058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.318033Z","title":"GraspXL: Generating grasp- ing motions for diverse objects at scale","venue":null,"work_id":"298f73d1-cfbd-446f-88be-7cefbbc73a88","year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.714372Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:bc408ff15953a487a18abd2c2da0aaac9e7a85c00e4a8cad04daa0643ae395bd","observation_id":"ace722ea-9992-4be1-8669-16a1d490f24a","resolution":{"observed_at":"2026-08-07T04:27:40.321825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.307897Z","title":"Scaling in-the-wild training for diffusion-based illu- mination harmonization and editing by imposing con- sistent light transport","venue":null,"work_id":"ad0ccfb1-d065-47e3-be23-ef6dfd2e3fba","year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.717591Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:d502f944b126ff2a71460c9bba9a8c9d3fb660642006e9511c2380e0b2dbda0e","observation_id":"b6bb6a67-7a95-48b9-9fc9-4757f429d5b2","resolution":{"observed_at":"2026-08-07T04:27:40.310964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12011","last_updated":"2024-03-18T17:48:31Z","snapshot_observed_at":"2026-08-17T10:53:26.092653Z","submitted_at":"2024-03-18T17:48:31Z","title":"HOIDiffusion: Generating Realistic 3D Hand-Object Interaction Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12011","snapshot_observed_at":"2026-08-07T04:27:39.720686Z","title":"Hoidiffusion: Gen- erating realistic 3d hand-object interaction data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.720686Z"},"links":{"cited_paper":"/paper/2403.12011","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:1c57588284ed3cfe81ea1064f86445fe0372ad8703dbee0eab7a64a4492d5fa0","observation_id":"71f4ff48-577b-46d3-ba0c-af78af43ee0f","resolution":{"observed_at":"2026-08-07T04:27:39.720686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.298442Z","title":"Place: Proximity learning of articula- tion and contact in 3d environments","venue":null,"work_id":"e3d0f0c9-4a51-4219-b808-3d173dc3e6a7","year":2020},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.723799Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:bb0428649de2083feed3bcc213293b0c5e859d3bb6e569913648077b98b03acf","observation_id":"67c8311f-e513-43bd-9e73-567f7dc2f4c7","resolution":{"observed_at":"2026-08-07T04:27:40.301670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.289578Z","title":"Generating 3d peo- ple in scenes without people","venue":null,"work_id":"4b4ef40c-d6eb-4a9e-9fc9-74112d1d09c6","year":2020},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.726786Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:a711e2d81edd9410ed1598130cb96cb0d8b8c4e9ea7fe04a6492302079956de4","observation_id":"f6ca67db-7fa0-41d3-b84f-94274ae71985","resolution":{"observed_at":"2026-08-07T04:27:40.292539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19680","last_updated":"2025-06-27T10:06:13Z","snapshot_observed_at":"2026-08-16T13:38:51.127960Z","submitted_at":"2024-06-28T06:40:53Z","title":"MimicMotion: High-Quality Human Motion Video Generation with Confidence-aware Pose Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19680","snapshot_observed_at":"2026-08-07T04:27:39.730057Z","title":"Mim- icmotion: High-quality human motion video gener- ation with confidence-aware pose guidance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.730057Z"},"links":{"cited_paper":"/paper/2406.19680","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:77ce87eb841c0d621464c74ecd71c74b6963d56ebc9476b832f78a4782e57692","observation_id":"f8f1eab8-550d-42a3-b78e-9eb5e89622d1","resolution":{"observed_at":"2026-08-07T04:27:39.730057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.280153Z","title":"Taste-rob: Advancing video generation of task-oriented hand- object interaction for generalizable robotic manipula- tion","venue":null,"work_id":"c9b88778-dee8-46b4-9a7b-5afa76a7429a","year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.733963Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:f060e64f214dc49f93787e3cd188c9c0a327e4dad65607fe58c419d3cd54b3d8","observation_id":"aaf3e795-92fc-431e-974d-0ce566f3dc47","resolution":{"observed_at":"2026-08-07T04:27:40.283164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14151","last_updated":"2025-07-02T11:55:35Z","snapshot_observed_at":"2026-08-17T04:58:51.328744Z","submitted_at":"2025-03-18T11:17:32Z","title":"Concat-ID: Towards Universal Identity-Preserving Video Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14151","snapshot_observed_at":"2026-08-07T04:27:39.737171Z","title":"Concat-id: Towards universal identity-preserving video synthesis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.737171Z"},"links":{"cited_paper":"/paper/2503.14151","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:da107f3724fba7ceb8bedd4f861a515aea2bd853bdc67b78be964b68cea8e342","observation_id":"85d35049-a87d-4a1e-bccb-bbee0484a637","resolution":{"observed_at":"2026-08-07T04:27:39.737171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14424","last_updated":"2025-02-24T08:35:58Z","snapshot_observed_at":"2026-08-16T13:16:31.710121Z","submitted_at":"2024-09-22T12:51:32Z","title":"Dormant: Defending against Pose-driven Human Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14424","snapshot_observed_at":"2026-08-07T04:27:39.740262Z","title":"Dormant: Defending against pose-driven human image animation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.740262Z"},"links":{"cited_paper":"/paper/2409.14424","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:c1fae6a450ec3f5845f336e54ae7756fffa6d8760ec8536a3e21053748db06b4","observation_id":"94344556-48c7-46aa-b9c7-ae81b92209de","resolution":{"observed_at":"2026-08-07T04:27:39.740262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:27:40.270787Z","title":"Champ: Controllable and consistent human image animation with 3d parametric guidance","venue":null,"work_id":"3966f2b6-c442-4167-b35d-91ac4a2425af","year":2024},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:39.743523Z"},"links":{"citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:a0c49cc73d2f668f0e98f888e343b8dcdfd8bc8800c13689f2cfbfe0064d2c6b","observation_id":"277c442e-89d3-4bc5-9851-628fea685f72","resolution":{"observed_at":"2026-08-07T04:27:40.274029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T20:45:09.381829Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":3,"verified_fuzzy":37},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 11 inbound Pith citation observations for arXiv:2506.10568."}