{"as_of":"2026-08-12T21:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3ed2f21bfb7bb8db3e9e402db6c28ac2da0568a222492fddf22172586e6216d8","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T04:31:13.614977Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.01343/citation-record","integrity":"/paper/2412.01343/integrity","json":"/paper/2412.01343/citation-record.json","paper":"/paper/2412.01343"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:14.581521Z","title":null,"venue":null,"work_id":"7b88f2aa-a9fd-4c9b-9d1b-1768edb9a368","year":2021},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.309062Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:25e3add815523caeba0bce576620c323ecf87d72b2b42a018ee82c34f61f6a77","observation_id":"9234e176-6c15-4b48-ab4a-92c5b69d5890","resolution":{"observed_at":"2026-08-12T04:31:14.586572Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:13.314571Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.314571Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:a347c72a8afdeea7d53eda030b1af1b0c61087c5c48fb55fa2f0bf71efc1e02c","observation_id":"76d078e3-e7a0-4358-95de-4c3ab6143957","resolution":{"observed_at":"2026-08-12T04:31:13.314571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:13.319622Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.319622Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:dc1a883682a07d9c6c8e82cc59c5550cf64628bd820aa2904c103b68195a87a6","observation_id":"f2e014de-53dc-46cf-9655-95246a8333ca","resolution":{"observed_at":"2026-08-12T04:31:13.319622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:13.324695Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.324695Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:e7abac265150eebb1c4bc9f5ec13ff5cebaf66fae71f2cb0a377f0ecb8845e83","observation_id":"4b8a29dd-0d01-410b-83d1-e687b659cd0b","resolution":{"observed_at":"2026-08-12T04:31:13.324695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:14.535570Z","title":null,"venue":null,"work_id":"917cd197-daa3-4bd9-bd71-ceed18a4a510","year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.330042Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:cd2ca4275cc4c6bc12aafe22c7ab2fd4cbbaef6515082b5dd661324c442142d7","observation_id":"e99f4269-74cf-4e58-8a8a-86dc69592009","resolution":{"observed_at":"2026-08-12T04:31:14.540571Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12052","last_updated":"2024-05-05T05:07:34Z","snapshot_observed_at":"2026-08-01T16:10:16.293275Z","submitted_at":"2023-11-18T10:22:44Z","title":"MagicPose: Realistic Human Poses and Facial Expressions Retargeting with Identity-aware Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12052","snapshot_observed_at":"2026-08-12T04:31:13.335189Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.335189Z"},"links":{"cited_paper":"/paper/2311.12052","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:4fb633e75786531f064f3568c65069e66dbb1480f02983e448fc7f5856a0a4da","observation_id":"de26be27-2c7d-4f09-9597-07f0689922f8","resolution":{"observed_at":"2026-08-12T04:31:13.335189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09047","last_updated":"2024-01-17T08:30:32Z","snapshot_observed_at":"2026-08-04T07:40:19.403363Z","submitted_at":"2024-01-17T08:30:32Z","title":"VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09047","snapshot_observed_at":"2026-08-12T04:31:13.341300Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.341300Z"},"links":{"cited_paper":"/paper/2401.09047","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:84da73051b8ffea920cf0a5f1155f8e29f1268258d630b5ff66b70bb4ab5be77","observation_id":"29075946-6ef8-4bf3-b349-d6634be62a44","resolution":{"observed_at":"2026-08-12T04:31:13.341300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-12T04:31:13.346516Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.346516Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:d856cb6408dcd46833e35474076b6ceba246c183645e12f370ac0396f9a8302a","observation_id":"43d9b4e4-128a-4a0b-ae08-eb42a2512a85","resolution":{"observed_at":"2026-08-12T04:31:13.346516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09481","last_updated":"2024-05-08T03:21:34Z","snapshot_observed_at":"2026-08-11T17:53:51.229692Z","submitted_at":"2023-07-18T17:59:02Z","title":"AnyDoor: Zero-shot Object-level Image Customization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09481","snapshot_observed_at":"2026-08-12T04:31:13.352086Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.352086Z"},"links":{"cited_paper":"/paper/2307.09481","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:5ea6b80e635e30045d1d3931164118d5a7dee6016aa8c315c5aea1b8556a3454","observation_id":"23a1815b-8eee-45f6-a2b0-64edda43ec26","resolution":{"observed_at":"2026-08-12T04:31:13.352086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-12T04:31:13.357634Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.357634Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:85f5127c9bac213be962befe9ecbb2268518c3684fe53579ed9f86a5e85a7bf6","observation_id":"8787f892-7b70-4cb0-9e28-a6fba74d7aa5","resolution":{"observed_at":"2026-08-12T04:31:13.357634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:13.362349Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.362349Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:a9e9fb71adba3ecb8ce3ed39bef6da220def7a310b4696e704d1be41eeb29254","observation_id":"121844f1-0484-43e4-9fbf-05df37c4bbb7","resolution":{"observed_at":"2026-08-12T04:31:13.362349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-12T04:31:13.366862Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.366862Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:a96114e2ec663afd470e011ee42f2740592a143cd06755782500cab5e95bb966","observation_id":"a51f6ec1-efc9-466c-a35a-5989a05f3463","resolution":{"observed_at":"2026-08-12T04:31:13.366862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:14.508848Z","title":null,"venue":null,"work_id":"9e1d1687-bbd8-4672-884e-4c9992c9af27","year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.372391Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:0ee23e3de910cbf80f28b008abd4af100ecd4e0c3aa6604ae071989db329d74a","observation_id":"4eed6def-cdd1-4dda-abef-313529b48d8b","resolution":{"observed_at":"2026-08-12T04:31:14.513792Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10709","last_updated":"2024-08-02T18:55:25Z","snapshot_observed_at":"2026-08-02T11:56:15.393496Z","submitted_at":"2023-11-17T18:59:04Z","title":"Emu Video: Factorizing Text-to-Video Generation by Explicit Image Conditioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10709","snapshot_observed_at":"2026-08-12T04:31:13.377340Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.377340Z"},"links":{"cited_paper":"/paper/2311.10709","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:389368b510830e1c6c9c86fe5f8f3a21b1932e6b6cdba38f53a64fe74d7438ef","observation_id":"15fc769f-c302-4013-a2d4-a16049c5069e","resolution":{"observed_at":"2026-08-12T04:31:13.377340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:13.382448Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.382448Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:5e99c296c720a9bc9624ca3945033231234a291cad63ad81f921257aeacb406b","observation_id":"fdbc1922-e196-40cd-9bd3-e71447c51d22","resolution":{"observed_at":"2026-08-12T04:31:13.382448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-08-12T14:50:50.360929Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-12T04:31:13.386941Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.386941Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:70b489a4f1b40082108a417e0c5d6a9ad0519cb53b93f5f7d7c6d8cf9ddb951e","observation_id":"15f418d9-cd54-49cb-9254-03446ac4492c","resolution":{"observed_at":"2026-08-12T04:31:13.386941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-07T19:06:02.627634Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-12T04:31:13.391642Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.391642Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:98776e410d9e2e3977e651d1c0c666450c656ce330ddb9f6af500eab0a6c9f71","observation_id":"04fd7fa5-41df-4b4f-aaf1-7f95a8f68394","resolution":{"observed_at":"2026-08-12T04:31:13.391642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-12T04:31:13.396929Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.396929Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:8fb7d0755a923de4abb985b0454d162c646dce885963abe08df913f52b02ef77","observation_id":"5a810251-e888-4c44-9801-8591da88f692","resolution":{"observed_at":"2026-08-12T04:31:13.396929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-12T04:31:13.402367Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.402367Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:0a46c7f5fb9ab5501a9831a4ad35144f2aac53de314443bfe06464efc0a65843","observation_id":"388c1280-a81d-498b-994c-34ac9d7ef84a","resolution":{"observed_at":"2026-08-12T04:31:13.402367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-12T19:28:23.372660Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-12T04:31:13.407663Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.407663Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:1771382d90d2af817c016e46f54c37f436aef276f49c46eadaa9e7b9bd138f72","observation_id":"02bb1c81-f631-48d5-ba20-de2aee63be0f","resolution":{"observed_at":"2026-08-12T04:31:13.407663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03458","last_updated":"2022-06-22T20:22:29Z","snapshot_observed_at":"2026-07-06T12:57:51.108636Z","submitted_at":"2022-04-07T14:08:02Z","title":"Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.03458","snapshot_observed_at":"2026-08-12T04:31:13.412413Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.412413Z"},"links":{"cited_paper":"/paper/2204.03458","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:6b2baa485e139d34a99b409002fc6e122d882cd35c822a818f6d1dff0e78aaba","observation_id":"c274d2d0-be22-4b0d-9932-1689e4002f69","resolution":{"observed_at":"2026-08-12T04:31:13.412413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17117","last_updated":"2024-06-13T06:37:20Z","snapshot_observed_at":"2026-08-10T23:27:53.135054Z","submitted_at":"2023-11-28T12:27:15Z","title":"Animate Anyone: Consistent and Controllable Image-to-Video Synthesis for Character Animation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17117","snapshot_observed_at":"2026-08-12T04:31:13.417590Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.417590Z"},"links":{"cited_paper":"/paper/2311.17117","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:cfab6806336badd7043ec3d92526a86597b6ce46e473559e59432f49026dd63c","observation_id":"299d23fb-f763-4ad3-a315-ea451aadca5c","resolution":{"observed_at":"2026-08-12T04:31:13.417590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-12T04:31:13.422490Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.422490Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:863358e5a419f504588555178534a21117797fa254e28d70a93b82802d7684bd","observation_id":"31f06a04-f5cd-4702-9d62-08b835c53296","resolution":{"observed_at":"2026-08-12T04:31:13.422490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:13.427949Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.427949Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:bfbc9f753119e7867dcb145c94603765b5446b3dc49dddb1697a0099ffdb4406","observation_id":"84e90dee-d7bc-4b5c-92f2-cc7436aaf2dd","resolution":{"observed_at":"2026-08-12T04:31:13.427949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:14.472807Z","title":null,"venue":null,"work_id":"bc91810d-f7f0-4fb6-94f0-fd95a8254b12","year":2020},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.432942Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:99c83f6517e95cbf74088b39cefcdd8958da93dd8417ef822c656250044ec613","observation_id":"603afb83-eecc-4cc3-953f-ee536cff5a1a","resolution":{"observed_at":"2026-08-12T04:31:14.477674Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19327","last_updated":"2023-05-30T18:00:06Z","snapshot_observed_at":"2026-08-03T09:55:47.236921Z","submitted_at":"2023-05-30T18:00:06Z","title":"Cones 2: Customizable Image Synthesis with Multiple Subjects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19327","snapshot_observed_at":"2026-08-12T04:31:13.437905Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.437905Z"},"links":{"cited_paper":"/paper/2305.19327","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:07afebea45a58a3ac147b4c0be75ed5cb02ded6ad09e6fe3efb4c8e4145e1068","observation_id":"dab88d6e-dc94-42c8-837f-b1fe1b1c1107","resolution":{"observed_at":"2026-08-12T04:31:13.437905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-12T04:31:13.442513Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.442513Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:515b8f3ff7aa9a83348dc7d5514c566be164c046f9a55cd2e23379c707486782","observation_id":"474e5297-7498-41a1-ad4c-17310fabaeeb","resolution":{"observed_at":"2026-08-12T04:31:13.442513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:14.456747Z","title":null,"venue":null,"work_id":"4b1dab51-5930-4fa6-9461-4d3810da4086","year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.447301Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:b89a639d0913ede9699e756e942fac16eda5e4f7aba1631f70932c660963ff4a","observation_id":"b4d07f95-915e-449e-b9f3-a6c4e5c45f05","resolution":{"observed_at":"2026-08-12T04:31:14.461730Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04966","last_updated":"2024-12-10T07:00:16Z","snapshot_observed_at":"2026-07-06T16:58:47.790985Z","submitted_at":"2023-12-07T18:59:03Z","title":"NewMove: Customizing text-to-video models with novel motions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04966","snapshot_observed_at":"2026-08-12T04:31:13.451785Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.451785Z"},"links":{"cited_paper":"/paper/2312.04966","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:d412b4b2e494478fa6fdaf80f6c6962fe8dadd75267d32977f2d20dd5eaedd84","observation_id":"93b0f482-0b33-40d8-9d55-60480bf93f5f","resolution":{"observed_at":"2026-08-12T04:31:13.451785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T04:31:13.456851Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.456851Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:d31f32933e0bb338b42ac8b0225b1fb4a5bf951967cbbf6c09b7b198ad057461","observation_id":"d3c1f9aa-90d3-4c99-98b2-b5fd5eac23a4","resolution":{"observed_at":"2026-08-12T04:31:13.456851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:13.462125Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.462125Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:bf51576654df1360120eb0899f530e63fe712ebda8bb89a8740c99b186b99d23","observation_id":"b4a2c106-28a9-4a2f-93cf-b16c3b4cb7bb","resolution":{"observed_at":"2026-08-12T04:31:13.462125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07697","last_updated":"2024-05-23T13:58:11Z","snapshot_observed_at":"2026-07-06T16:31:25.350087Z","submitted_at":"2023-10-11T17:46:28Z","title":"ConditionVideo: Training-Free Condition-Guided Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":"2310.07697","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.07697","snapshot_observed_at":"2026-08-12T04:31:13.960608Z","title":"ConditionVideo: Training-Free Condition-Guided Text-to-Video Generation","venue":"cs.CV","work_id":"f34a0c34-b26b-41d4-a975-c69f0f7b84b9","year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.467840Z"},"links":{"cited_paper":"/paper/2310.07697","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:6f25d116b1963a09a6162d42ef1a1776323c2ccbdd264412f22e05536a1c2436","observation_id":"fe303ae9-2f91-48a7-bbd5-d43d0fe167bd","resolution":{"observed_at":"2026-08-12T04:31:13.966312Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:14.428663Z","title":null,"venue":null,"work_id":"7dc999e8-584c-4f78-9cdc-ab605c18ecf0","year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.473630Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:9025ca87714398fb4625e71f80bd01ae8ab15c5f3df929478c9d8483a5b45949","observation_id":"66ac0623-18dc-41e0-8d73-d26ce7c9c1bd","resolution":{"observed_at":"2026-08-12T04:31:14.434357Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14780","last_updated":"2024-08-28T01:13:44Z","snapshot_observed_at":"2026-08-12T08:01:23.492817Z","submitted_at":"2024-02-22T18:38:48Z","title":"Customize-A-Video: One-Shot Motion Customization of Text-to-Video Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14780","snapshot_observed_at":"2026-08-12T04:31:13.479256Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.479256Z"},"links":{"cited_paper":"/paper/2402.14780","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:329194af470382c7ba2c90fa6147daeb8e89bce2c1463fc96d72d8d1f4fdeb44","observation_id":"55cdba49-4c7f-4039-ab57-45574837293c","resolution":{"observed_at":"2026-08-12T04:31:13.479256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10752","last_updated":"2022-04-13T11:38:44Z","snapshot_observed_at":"2026-07-06T12:20:47.369918Z","submitted_at":"2021-12-20T18:55:25Z","title":"High-Resolution Image Synthesis with Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10752","snapshot_observed_at":"2026-08-12T04:31:13.484091Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.484091Z"},"links":{"cited_paper":"/paper/2112.10752","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:2fda553dfd1d2597c101a9b33e033c02bd77ff18b75cf2e2bd160088bff0f35a","observation_id":"18cc6c00-253c-4326-9e9d-1dc53b2043de","resolution":{"observed_at":"2026-08-12T04:31:13.484091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:13.488983Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.488983Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:579bdef40485fea9a8d5454e2246732381b6daf3381e37182f3477511bcebe7d","observation_id":"2817aa6c-1f77-44ea-8b5d-36b33dbe648d","resolution":{"observed_at":"2026-08-12T04:31:13.488983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-12T04:31:13.494262Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.494262Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:2411d361c1472b7ae10498dc6d89639afde1f7adbc7542c3433ec01d4d5e11a9","observation_id":"97a66ee7-cdc5-4b8d-bae4-c0f68f1df2eb","resolution":{"observed_at":"2026-08-12T04:31:13.494262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:14.399527Z","title":null,"venue":null,"work_id":"03869813-1ce3-45e6-998a-421e3626beda","year":2021},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.498677Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:c3977c5c0cb7ec583b699315afaaab11f1a83d0a617cbff9e714c7cdaa740b63","observation_id":"dd048b6c-e6cb-4dfb-b40d-aa944795b7a6","resolution":{"observed_at":"2026-08-12T04:31:14.404333Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:14.382941Z","title":null,"venue":null,"work_id":"ef3a2f23-53fd-45b8-bd4f-c244499c6471","year":2015},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.503277Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:c29f59a7868eb0c6ec6544d851f2c0860ed7e9bbed53f40a7959aec6abbea414","observation_id":"94f116c9-dd97-4cc6-b290-db2dc1f65051","resolution":{"observed_at":"2026-08-12T04:31:14.388677Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-08-12T17:34:19.526460Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-12T04:31:13.508090Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.508090Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:bb9191074395b408458b24d97c584fa69437b7617b58163b274ad5f632a64b7b","observation_id":"508a9b88-12d8-4df3-addf-eb255d6c9e8f","resolution":{"observed_at":"2026-08-12T04:31:13.508090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:13.512876Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.512876Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:0099a8e8298448bb3f6da2cffdeae4a46c5bbda089e2cb7ba4ce0cb8c18a1211","observation_id":"8c019293-f91e-4bfc-b7c4-4b426805086f","resolution":{"observed_at":"2026-08-12T04:31:13.512876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06571","last_updated":"2023-08-12T13:53:10Z","snapshot_observed_at":"2026-08-10T01:52:30.999213Z","submitted_at":"2023-08-12T13:53:10Z","title":"ModelScope Text-to-Video Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06571","snapshot_observed_at":"2026-08-12T04:31:13.517962Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.517962Z"},"links":{"cited_paper":"/paper/2308.06571","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:879d2250f8a6880e980a20bc5c1f6fe9e8b6d2064c4e721b429bac01a1425ce8","observation_id":"946d82ac-5e8a-41a9-84ad-f66163345ede","resolution":{"observed_at":"2026-08-12T04:31:13.517962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15975","last_updated":"2024-01-29T09:06:15Z","snapshot_observed_at":"2026-08-05T14:33:09.454320Z","submitted_at":"2024-01-29T09:06:15Z","title":"StableIdentity: Inserting Anybody into Anywhere at First Sight","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15975","snapshot_observed_at":"2026-08-12T04:31:13.523396Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.523396Z"},"links":{"cited_paper":"/paper/2401.15975","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:8011d4b77ebd7ac0484a75a4c3ccf7cfbdc74efcd534ae1c4fdfc6049c6ae448","observation_id":"08398e74-f11a-4003-8f35-1f02cbd96344","resolution":{"observed_at":"2026-08-12T04:31:13.523396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15103","last_updated":"2023-09-27T03:51:52Z","snapshot_observed_at":"2026-07-06T16:23:57.143116Z","submitted_at":"2023-09-26T17:52:03Z","title":"LAVIE: High-Quality Video Generation with Cascaded Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15103","snapshot_observed_at":"2026-08-12T04:31:13.528881Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.528881Z"},"links":{"cited_paper":"/paper/2309.15103","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:c4d97174f83daf43ae6b489dfd681c397a808f2ee58cf5d3e37264910108aa11","observation_id":"49cfa722-8db4-4151-b241-807b37e92533","resolution":{"observed_at":"2026-08-12T04:31:13.528881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04433","last_updated":"2023-12-07T16:57:26Z","snapshot_observed_at":"2026-08-06T19:35:11.522056Z","submitted_at":"2023-12-07T16:57:26Z","title":"DreamVideo: Composing Your Dream Videos with Customized Subject and Motion","version":1},"cited_work":{"arxiv_id":"2312.04433","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.04433","snapshot_observed_at":"2026-08-12T04:31:13.812959Z","title":"DreamVideo: Composing Your Dream Videos with Customized Subject and Motion","venue":"cs.CV","work_id":"0f363640-d293-4aca-89fa-79310e0fec15","year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.534209Z"},"links":{"cited_paper":"/paper/2312.04433","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:ce8b22beea429ca67d78ae2fcb12b337b1659e908018fd9024fb8474e8413b8c","observation_id":"e98d2e16-8537-4ce6-9cb9-67bba0400c27","resolution":{"observed_at":"2026-08-12T04:31:13.820133Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:13.540335Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.540335Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:7ca3254ca5420514c1f98c71ccea087d8d6ffdf09df4cf2f67483b47f742f0e3","observation_id":"84993e0e-465d-4908-92c6-6fdf0ef17818","resolution":{"observed_at":"2026-08-12T04:31:13.540335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10769","last_updated":"2023-10-16T19:03:19Z","snapshot_observed_at":"2026-08-11T04:47:35.544997Z","submitted_at":"2023-10-16T19:03:19Z","title":"LAMP: Learn A Motion Pattern for Few-Shot-Based Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10769","snapshot_observed_at":"2026-08-12T04:31:13.545317Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.545317Z"},"links":{"cited_paper":"/paper/2310.10769","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:64dd483441d5a24b8ca92d31dc2a7fa2168d5d9dce4b9c817f9796390aaafebd","observation_id":"85b0986c-0e57-4442-9050-1c9b9fb6f783","resolution":{"observed_at":"2026-08-12T04:31:13.545317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16498","last_updated":"2023-11-27T18:32:31Z","snapshot_observed_at":"2026-08-07T23:43:39.887168Z","submitted_at":"2023-11-27T18:32:31Z","title":"MagicAnimate: Temporally Consistent Human Image Animation using Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16498","snapshot_observed_at":"2026-08-12T04:31:13.552475Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.552475Z"},"links":{"cited_paper":"/paper/2311.16498","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:0730fd02b7881ff1e43ebbaf6ab63b90e38a9aec2b5146db6d8a8b25abb7bba6","observation_id":"dd97f14d-708a-49ae-9cf6-a76908e23a5c","resolution":{"observed_at":"2026-08-12T04:31:13.552475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:14.346007Z","title":null,"venue":null,"work_id":"62436ac9-e9c9-4bb7-aad5-e264a9af425e","year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.557830Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:9310344beea0a1007b3a0789ca7d56dc8e23f734ed0bf632323925b94ce7b87e","observation_id":"28ef54cf-e980-4537-beca-ed6d3afd79ed","resolution":{"observed_at":"2026-08-12T04:31:14.350680Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:13.563463Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.563463Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:431327d968056f51ac06436f934f83d4330de08bce8513539d0cd822379a64f3","observation_id":"648cd68c-76c5-46e8-8016-e4fded1e3b9d","resolution":{"observed_at":"2026-08-12T04:31:13.563463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:13.575718Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.575718Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:17ff5e21addba6e3a691f8e9c856ead692b06763e4dbd55c4f86111fe0fe24a1","observation_id":"2912cf5d-e087-45ff-839e-2cc409c9e5ec","resolution":{"observed_at":"2026-08-12T04:31:13.575718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10982","last_updated":"2023-11-18T06:25:58Z","snapshot_observed_at":"2026-08-12T12:25:01.468619Z","submitted_at":"2023-11-18T06:25:58Z","title":"Make Pixels Dance: High-Dynamic Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10982","snapshot_observed_at":"2026-08-12T04:31:13.583545Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.583545Z"},"links":{"cited_paper":"/paper/2311.10982","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:e1634103fc6e6c4cae8b8d1a56f9d606e7f2c045a8680b2fb86d3eb59d89c940","observation_id":"83d3aaaf-815a-41a9-85d3-5d39998d8ef1","resolution":{"observed_at":"2026-08-12T04:31:13.583545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05288","last_updated":"2024-01-02T10:39:11Z","snapshot_observed_at":"2026-07-06T16:58:59.299777Z","submitted_at":"2023-12-08T16:31:04Z","title":"MotionCrafter: One-Shot Motion Customization of Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05288","snapshot_observed_at":"2026-08-12T04:31:13.590405Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.590405Z"},"links":{"cited_paper":"/paper/2312.05288","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:0dc26188da8485c329fb060ea4e64d50de0575972634e5e728e04225603155d5","observation_id":"bbc65833-949d-4a9a-a05e-4204bb490bf7","resolution":{"observed_at":"2026-08-12T04:31:13.590405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06710","last_updated":"2023-08-04T03:07:41Z","snapshot_observed_at":"2026-08-10T09:39:36.124415Z","submitted_at":"2023-05-11T10:36:52Z","title":"Null-text Guidance in Diffusion Models is Secretly a Cartoon-style Creator","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06710","snapshot_observed_at":"2026-08-12T04:31:13.597611Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.597611Z"},"links":{"cited_paper":"/paper/2305.06710","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:648c658f776e537cb4883f7977f99752204deafc24ea3129b21f0501f8dc2ff6","observation_id":"8491d59e-ca00-45b2-a8ea-c2fd62a06278","resolution":{"observed_at":"2026-08-12T04:31:13.597611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08465","last_updated":"2023-10-12T16:26:18Z","snapshot_observed_at":"2026-07-06T16:32:00.957275Z","submitted_at":"2023-10-12T16:26:18Z","title":"MotionDirector: Motion Customization of Text-to-Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08465","snapshot_observed_at":"2026-08-12T04:31:13.603892Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.603892Z"},"links":{"cited_paper":"/paper/2310.08465","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:125bde0cd8510d0706243964a82a14fee2a8690aee8a3f8d833c7cca2224fbc7","observation_id":"b66388de-56a2-4052-801a-a04e2074ddb3","resolution":{"observed_at":"2026-08-12T04:31:13.603892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11018","last_updated":"2023-05-11T11:23:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-20T16:40:31Z","title":"MagicVideo: Efficient Video Generation With Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11018","snapshot_observed_at":"2026-08-12T04:31:13.609351Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.609351Z"},"links":{"cited_paper":"/paper/2211.11018","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:d5ea0f2c5a09d72987c0f4622e2f63c54a4d63fe19b3ebf0e2c928cd2bdb04ca","observation_id":"0079aa71-614c-4676-aa24-8c3794f69a44","resolution":{"observed_at":"2026-08-12T04:31:13.609351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:31:14.308212Z","title":"A tiger is drinking water in the forest","venue":null,"work_id":"e98430db-33ba-448d-99b4-2b9b260d4bcf","year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.614977Z"},"links":{"citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:fda8cf93ab1ef9a0ecb0d998131d7e2a0621e9fa57ead025ef9a52d26ccd1fff","observation_id":"3fc4d656-f517-464c-9cc7-2b5a8cc6c852","resolution":{"observed_at":"2026-08-12T04:31:14.313258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11708","last_updated":"2024-05-05T04:50:54Z","snapshot_observed_at":"2026-08-06T07:45:20.379717Z","submitted_at":"2024-01-22T06:16:29Z","title":"Mastering Text-to-Image Diffusion: Recaptioning, Planning, and Generating with Multimodal LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11708","snapshot_observed_at":"2026-08-12T04:31:13.568607Z","title":"arXiv preprint arXiv:2401.11708 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.568607Z"},"links":{"cited_paper":"/paper/2401.11708","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:784994d8ebd7ef8cfc99f3c24141827bbc9ee045c85ed882052bda56ca7d21f9","observation_id":"c7a4ae6b-1162-475b-97a1-3215af1bbe90","resolution":{"observed_at":"2026-08-12T04:31:13.568607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T17:13:36.143134Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":55,"verified_exact":2,"verified_fuzzy":1},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2412.01343."}