{"as_of":"2026-08-07T16:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ecae26d8155c97e4342833dcfc57abd9c7caf66f286d9090ce7fc9d7e9c94d60","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:13:04.545571Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T13:15:54.413960Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T13:18:18.371408Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"cited_work":{"arxiv_id":"2506.17301","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17301","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Frameprompt: In-context controllable animation with zero structural changes.ArXiv, abs/2506.17301","venue":null,"work_id":"f655834c-19fb-44ea-b7df-d303f1dc1242","year":2025},"citing_paper":{"arxiv_id":"2605.17423","last_updated":"2026-05-17T12:38:21Z","snapshot_observed_at":"2026-08-01T16:00:11.560764Z","submitted_at":"2026-05-17T12:38:21Z","title":"Soap2Soap: Long Cinematic Video Remaking via Multi-Agent Collaboration","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T13:15:54.413960Z"},"links":{"cited_paper":"/paper/2506.17301","citing_paper":"/paper/2605.17423"},"observation_digest":"sha256:fa87e549ba6314aa26da90cc1fed111574164e8173d44e61183798b26dae3daa","observation_id":"c43e26b2-0588-44bf-a195-fd2a5a9d59c8","resolution":{"observed_at":"2026-05-20T13:18:18.373189Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.17301/citation-record","integrity":"/paper/2506.17301/integrity","json":"/paper/2506.17301/citation-record.json","paper":"/paper/2506.17301"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.292677Z","title":"Animate anyone: Consistent and controllable image-to-video synthesis for character animation","venue":null,"work_id":"070528f9-99d2-4d3a-9215-9a44bf82bbf8","year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.343413Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:d40f6ca0f37717f433954952b62bd1f1ab6de9a59b6b534b4f81192914350fea","observation_id":"96246475-7d2a-4811-94f9-86869313eb5f","resolution":{"observed_at":"2026-08-07T00:13:05.296471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.283205Z","title":"Magicanimate: Temporally consistent human image animation using diffusion model","venue":null,"work_id":"8ed73824-46f0-44ee-b911-9830e34bfafa","year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.347438Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:1486225933a3128f52abaf181102d39db763efb3bd6781016385dd5a56fd91b1","observation_id":"6c9359a7-9397-4abf-a08b-36ea418c0833","resolution":{"observed_at":"2026-08-07T00:13:05.286388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-07-06T20:33:43.357335Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-08-07T00:13:04.352220Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.352220Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:4910270a9baba66c604edd5c9fed86166d4a04d6f3b2641fd8a1f98312dbe75d","observation_id":"1cc7201a-db07-4885-9b1f-12cfab2fb098","resolution":{"observed_at":"2026-08-07T00:13:04.352220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.273410Z","title":"Champ: Controllable and consistent human image animation with 3d parametric guidance","venue":null,"work_id":"8128926e-8976-47d3-954b-e77b459f9a1c","year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.356485Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:34e4a9b819e0d214a6f6c53ac17728b515528759439a4aeae93b8549a4a1da82","observation_id":"d4cfdd6b-6c7f-4b1b-b8a7-6a1468ef6e9c","resolution":{"observed_at":"2026-08-07T00:13:05.276803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.260931Z","title":"Disco: Disentangled control for realistic human dance generation","venue":null,"work_id":"404101fe-6e54-41f8-a4bf-316d9e587c3f","year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.360156Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:16c192f3fb62dce58f24625afbd7d7cf89f101667015aeddc9bbca596bbf53bd","observation_id":"78ec2d7b-8a8c-4f06-aee6-d101225a50bf","resolution":{"observed_at":"2026-08-07T00:13:05.265605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.250266Z","title":"Musepose: a pose- driven image-to-video framework for virtual human generation","venue":null,"work_id":"2d2827c4-5efb-4fa2-94d3-cb78290e733f","year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.368632Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:7b8044e523491378a4885d7cacb73e457ebbc4c78a809f8104d87753d6c240e2","observation_id":"7dda0fe7-a453-4f8c-a5d9-3db978042cd1","resolution":{"observed_at":"2026-08-07T00:13:05.253639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.240623Z","title":"https://github.com/MooreThreads/Moore-AnimateAnyone, 2024","venue":null,"work_id":"838de960-6ae2-49ee-b26c-4b2027ecb9b0","year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.371952Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:612f110b52f81afb6b27d2c133e98b4d306ea32faee4fd6819b6ba79b7a854ce","observation_id":"592991b7-04d5-4d45-a362-b417471fc14d","resolution":{"observed_at":"2026-08-07T00:13:05.243821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06202","last_updated":"2024-09-10T04:14:11Z","snapshot_observed_at":"2026-07-06T19:12:57.997252Z","submitted_at":"2024-09-10T04:14:11Z","title":"RealisDance: Equip controllable character animation with realistic hands","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06202","snapshot_observed_at":"2026-08-07T00:13:04.375683Z","title":"Realisdance: Equip controllable character animation with realistic hands","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.375683Z"},"links":{"cited_paper":"/paper/2409.06202","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:227bd8f952292c835e8af69e33abc44202ad1c224a67b3fe39d5d5c89c3c3a30","observation_id":"dd9ce742-3930-4327-88d0-e8a54ea4e74f","resolution":{"observed_at":"2026-08-07T00:13:04.375683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.230791Z","title":"https://viggleai.io/, 2024","venue":null,"work_id":"56d6ca09-15c1-4490-b1cc-e26853412cbd","year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.379112Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:73bafa8c68d4a625acd7a5bc7af56469a8ec4689a0e2a5fb062d6586591f755d","observation_id":"2a27de1b-b39c-45e7-9766-af74dbcc3855","resolution":{"observed_at":"2026-08-07T00:13:05.234378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06070","last_updated":"2025-03-08T08:43:03Z","snapshot_observed_at":"2026-07-06T18:59:34.520274Z","submitted_at":"2024-08-12T11:41:18Z","title":"ControlNeXt: Powerful and Efficient Control for Image and Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06070","snapshot_observed_at":"2026-08-07T00:13:04.382673Z","title":"Con- trolnext: Powerful and efficient control for image and video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.382673Z"},"links":{"cited_paper":"/paper/2408.06070","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:07d18ec3718dd69ae2c744319ff54965c0315794761d5361e47f9ca1d54c52dd","observation_id":"fe5ec185-2b96-4236-ac70-6bf32837d714","resolution":{"observed_at":"2026-08-07T00:13:04.382673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.221247Z","title":"https://github.com/aigc-apps/VideoX-Fun, 2025","venue":null,"work_id":"5029d902-9a2b-4164-9bf2-3c1e2fb79d5e","year":2025},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.386106Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:5b8fa3a2850b834091a928b74db7b8a9eabbd43e94b047ff1e6f4fbd0f870664","observation_id":"53f056ef-b6d6-40c5-be69-c9b9a53c0f8d","resolution":{"observed_at":"2026-08-07T00:13:05.224508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.211465Z","title":"Unianimate: Taming unified video diffusion models for consistent human image animation","venue":null,"work_id":"bcfbe916-92d3-4ada-bd05-d70ed8755b99","year":2025},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.389461Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:0092c8b82b105ede3cf1b78530b5e250a80d090fcf52879dfcaef60f8b870b35","observation_id":"0d49bb09-50ac-459c-ad33-eba692603f5c","resolution":{"observed_at":"2026-08-07T00:13:05.215245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10841","last_updated":"2025-02-15T16:08:40Z","snapshot_observed_at":"2026-08-03T18:37:17.161370Z","submitted_at":"2025-02-15T16:08:40Z","title":"SkyReels-A1: Expressive Portrait Animation in Video Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10841","snapshot_observed_at":"2026-08-07T00:13:04.393223Z","title":"Skyreels-a1: Expressive portrait animation in video diffusion transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.393223Z"},"links":{"cited_paper":"/paper/2502.10841","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:43963811d74734e4e23b6fed531e76992e93afbfd2db2f752dcde370f1849c76","observation_id":"69a47d20-e42d-448f-ac51-6da15b1abae0","resolution":{"observed_at":"2026-08-07T00:13:04.393223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:04.397035Z","title":"Experiment with gemini 2.0 flash native image generation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.397035Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:1512a111020b8fdeb5e04d08ee88ccf5e18a6503c59fa6cf8ce4c59b044240d0","observation_id":"35dbcf16-63b3-449c-9357-17554706d1ef","resolution":{"observed_at":"2026-08-07T00:13:04.397035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:04.400215Z","title":"Introducing 4o image generation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.400215Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:6c2acf7fc351edec36079be21ffeaeeee48b9118c5b1e42ee5adcf6a0af3e533","observation_id":"cbc90605-3398-40ae-9bc8-22f277f7c39b","resolution":{"observed_at":"2026-08-07T00:13:04.400215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17761","last_updated":"2025-07-31T05:05:45Z","snapshot_observed_at":"2026-07-06T21:14:24.007428Z","submitted_at":"2025-04-24T17:25:12Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17761","snapshot_observed_at":"2026-08-07T00:13:04.403644Z","title":"Step1x-edit: A practical framework for general image editing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.403644Z"},"links":{"cited_paper":"/paper/2504.17761","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:2fae411fed8a7af9baa1d295a23f13c83d6a72b0bf0e11e65b046285e6e7a904","observation_id":"c8378dc2-5bcf-4c4b-9c0b-994ef392c941","resolution":{"observed_at":"2026-08-07T00:13:04.403644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21356","last_updated":"2025-07-15T09:23:42Z","snapshot_observed_at":"2026-08-07T15:58:07.471187Z","submitted_at":"2025-04-30T06:30:48Z","title":"Nexus-Gen: Unified Image Understanding, Generation, and Editing via Prefilled Autoregression in Shared Embedding Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21356","snapshot_observed_at":"2026-08-07T00:13:04.407079Z","title":"Nexus- gen: A unified model for image understanding, generation, and editing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.407079Z"},"links":{"cited_paper":"/paper/2504.21356","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:defb58880919ba741ce5eaecb491446f29fdc1eb3ac392d42c0e5d331e9b4c3d","observation_id":"015d4220-caf7-4f54-9ea6-8e7f72ed06ff","resolution":{"observed_at":"2026-08-07T00:13:04.407079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03458","last_updated":"2022-06-22T20:22:29Z","snapshot_observed_at":"2026-07-06T12:57:51.108636Z","submitted_at":"2022-04-07T14:08:02Z","title":"Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.03458","snapshot_observed_at":"2026-08-07T00:13:04.410773Z","title":"Video diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.410773Z"},"links":{"cited_paper":"/paper/2204.03458","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:bf71630465cb1cce974a788ff2497f862d9ca17ea46d044932bdcb172c834e5c","observation_id":"d66b0dab-698c-4066-a94d-40c3e046c004","resolution":{"observed_at":"2026-08-07T00:13:04.410773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:04.415045Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.415045Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:18793c6e889a2ffe06290069bda095b4322242f1e3d292f9cfe83af2f452f887","observation_id":"fae3c822-4339-44c5-b68e-edf0459249b8","resolution":{"observed_at":"2026-08-07T00:13:04.415045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-07T00:13:04.418305Z","title":"Pixart- α: Fast training of diffusion transformer for photorealistic text-to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.418305Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:6106ede85059f9f9d2227e9606fa626a92c3e3305a3ec8ba3809642430a671ae","observation_id":"bd267e51-f7e1-4351-b089-6bb8a63d212d","resolution":{"observed_at":"2026-08-07T00:13:04.418305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11018","last_updated":"2023-05-11T11:23:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-20T16:40:31Z","title":"MagicVideo: Efficient Video Generation With Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11018","snapshot_observed_at":"2026-08-07T00:13:04.421947Z","title":"Magicvideo: Efficient video generation with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.421947Z"},"links":{"cited_paper":"/paper/2211.11018","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:5ff07bf119b9734029815705b2a64f002cec4e1f208149d354e663cb8143bd2f","observation_id":"934a7e02-d384-4ae4-bcc0-cdc02a3e0c2b","resolution":{"observed_at":"2026-08-07T00:13:04.421947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06571","last_updated":"2023-08-12T13:53:10Z","snapshot_observed_at":"2026-07-06T16:05:35.645037Z","submitted_at":"2023-08-12T13:53:10Z","title":"ModelScope Text-to-Video Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06571","snapshot_observed_at":"2026-08-07T00:13:04.425617Z","title":"Modelscope text-to-video technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.425617Z"},"links":{"cited_paper":"/paper/2308.06571","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:6e4b236cc2e8be654fb2efd7acb3a08ef8969e6ed5cb47057d3962556ecf5e0d","observation_id":"44056535-24b9-4f53-b059-542c5fa85522","resolution":{"observed_at":"2026-08-07T00:13:04.425617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:04.429323Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning.International Conference on Learning Representations, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.429323Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:75150e4320f3c6b22f37f305028d46ecadc9091862d305a11af96f71c3a49ac9","observation_id":"917b8228-3496-438a-9f46-cdcf534cc63b","resolution":{"observed_at":"2026-08-07T00:13:04.429323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.178247Z","title":null,"venue":null,"work_id":"574960d7-1d54-4883-aafd-924fa784b392","year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.432697Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:8aac3763be0b66270914319eb754fd3c9825bb6c1b8272dcbbb083790cda8846","observation_id":"5d6bf182-4f14-4ea8-b38b-719be0910d36","resolution":{"observed_at":"2026-08-07T00:13:05.181155Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-07T00:13:04.435873Z","title":"Hunyuanvideo: A systematic framework for large video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.435873Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:be7ae1fd2aabb819d2d3848d3545e004d05341a9bb7251ab3b1f73a9c20cc27d","observation_id":"29942253-438f-418d-9d09-833e81c4a9f0","resolution":{"observed_at":"2026-08-07T00:13:04.435873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-07T00:13:04.439401Z","title":"Wan: Open and advanced large-scale video generative models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.439401Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:3142b2439cfe467f718d7f17f75f69fde45cea8bfd71ecc5c6b6e18e938d17d7","observation_id":"a38acf71-c162-4177-87eb-11343ebfeab4","resolution":{"observed_at":"2026-08-07T00:13:04.439401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-07T00:13:04.443046Z","title":"Ltx-video: Realtime video latent diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.443046Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:cc0a9f28d7c6de8864cec28f8aa3ac2c28ce281ab35a8c7efc2bdcecf64a5bff","observation_id":"9add0f22-6aa2-4592-bbec-1788c7473410","resolution":{"observed_at":"2026-08-07T00:13:04.443046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:04.446401Z","title":"Open-sora: Democratizing efficient video production for all, March 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.446401Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:c2d29f3324d1bb5b4ec36e2e1d506c653883df540acdf616f8a195eac0d83337","observation_id":"2da2aa3b-76d4-45c4-b979-131ed9b3d835","resolution":{"observed_at":"2026-08-07T00:13:04.446401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00131","last_updated":"2024-11-28T14:07:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-28T14:07:45Z","title":"Open-Sora Plan: Open-Source Large Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00131","snapshot_observed_at":"2026-08-07T00:13:04.449523Z","title":"Open-sora plan: Open-source large video generation model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.449523Z"},"links":{"cited_paper":"/paper/2412.00131","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:29347635716569624c1afa643ff80f53a55f5b9af454b965686eb541ee5e3756","observation_id":"c3ee1cf3-2075-4c93-a634-aa4153da944a","resolution":{"observed_at":"2026-08-07T00:13:04.449523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:04.453446Z","title":"Pyramidal flow matching for efficient video generative modeling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.453446Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:81a190cae1be5875bd6c9c14f51e4ddf381e9d3d740b6470bf9e3a31cadd9ed7","observation_id":"16edb292-250a-4912-bad3-98188a150376","resolution":{"observed_at":"2026-08-07T00:13:04.453446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.163026Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","venue":null,"work_id":"5fe7a803-b9a3-419c-b42c-03e9eef72c30","year":2025},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.456663Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:26ba6d8c62cedf65356329e5473733b03f00b7cb7e68d360c553a780d40a95f2","observation_id":"2320438b-7f83-4a9e-9f34-39b997629038","resolution":{"observed_at":"2026-08-07T00:13:05.166011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.154393Z","title":"First order motion model for image animation","venue":null,"work_id":"42f97224-50c1-444f-912a-eb4768aa9806","year":2019},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.459821Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:e19c8c45901f67d22d7e2616a8a94c777dec2256b4d230d94638dd61a181b455","observation_id":"985cc28e-c928-4338-bfa6-053f554279fb","resolution":{"observed_at":"2026-08-07T00:13:05.157464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.145252Z","title":"Woodford, Jian Ren, Menglei Chai, and Sergey Tulyakov","venue":null,"work_id":"7e75cb90-7616-426a-bd41-c527b844061f","year":2021},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.463139Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:422eb1df1824b1ee101b1a90595ae63f5dee4099907ff9f81a91d7594dea1c66","observation_id":"faaa78b4-51a0-402d-8afa-dea4f56f11ac","resolution":{"observed_at":"2026-08-07T00:13:05.148409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10306","last_updated":"2024-12-11T02:55:31Z","snapshot_observed_at":"2026-08-07T06:22:46.243818Z","submitted_at":"2024-10-14T09:06:55Z","title":"Animate-X: Universal Character Image Animation with Enhanced Motion Representation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10306","snapshot_observed_at":"2026-08-07T00:13:04.467875Z","title":"Animate-x: Universal character image animation with enhanced motion representation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.467875Z"},"links":{"cited_paper":"/paper/2410.10306","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:fb63e3aad0b683fa69b4e2600ff520a979b3b6f7fa1c532b6391ed49bc3a9fa9","observation_id":"172e255a-dcc4-4443-8caa-db869224dad8","resolution":{"observed_at":"2026-08-07T00:13:04.467875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.135815Z","title":"Humanvid: Demystifying training data for camera-controllable human image animation","venue":null,"work_id":"d6cfbae1-0067-4303-bd3b-411e11491ed2","year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.471690Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:88eda0bece8aedd0457c9ea0c8d78223d3145c77b1b95b2d3cdbf5aa3d267cdc","observation_id":"901f5ffc-6392-4bd1-8278-8c88c6ace5d3","resolution":{"observed_at":"2026-08-07T00:13:05.139221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01061","last_updated":"2025-06-30T08:26:56Z","snapshot_observed_at":"2026-07-06T20:30:02.903743Z","submitted_at":"2025-02-03T05:17:32Z","title":"OmniHuman-1: Rethinking the Scaling-Up of One-Stage Conditioned Human Animation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01061","snapshot_observed_at":"2026-08-07T00:13:04.475193Z","title":"Omnihuman-1: Rethinking the scaling-up of one-stage conditioned human animation models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.475193Z"},"links":{"cited_paper":"/paper/2502.01061","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:51a3c28bf8f1f86e0084b15b6a297101f1c9e6501b2cf0ec4234506d8c28bd36","observation_id":"5bb938c0-0572-4b7f-b182-486a0e0fdeb1","resolution":{"observed_at":"2026-08-07T00:13:04.475193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04847","last_updated":"2025-08-04T07:36:34Z","snapshot_observed_at":"2026-08-05T01:30:44.891750Z","submitted_at":"2025-02-07T11:36:36Z","title":"HumanDiT: Pose-Guided Diffusion Transformer for Long-form Human Motion Video Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04847","snapshot_observed_at":"2026-08-07T00:13:04.478492Z","title":"Humandit: Pose-guided diffusion transformer for long-form human motion video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.478492Z"},"links":{"cited_paper":"/paper/2502.04847","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:3a8de606f199ea67d350c3003db180488bfcb38890bdd8899f0cc5797bba8c45","observation_id":"c953dc74-b63c-44c1-9bdf-5a01e206b2bc","resolution":{"observed_at":"2026-08-07T00:13:04.478492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07598","last_updated":"2025-03-11T06:44:25Z","snapshot_observed_at":"2026-07-06T20:50:05.070886Z","submitted_at":"2025-03-10T17:57:04Z","title":"VACE: All-in-One Video Creation and Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07598","snapshot_observed_at":"2026-08-07T00:13:04.481982Z","title":"Vace: All-in-one video creation and editing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.481982Z"},"links":{"cited_paper":"/paper/2503.07598","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:de647a829aaf5bbcdddc023a01ecac6d936e5f9c80c3c28ee3736daaa41496a8","observation_id":"77d610c9-a113-4e4c-b5eb-2ee9704a334a","resolution":{"observed_at":"2026-08-07T00:13:04.481982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.126336Z","title":"Humandit: Pose-guided diffusion transformer for long-form human motion video generation, 2025","venue":null,"work_id":"8c1c0a7f-7782-46d4-b4e9-939fa41885f1","year":2025},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.485778Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:eab21508d18a158c961fe29ab93fc5d4dfcc2a9dde18ede68e87f4436164f510","observation_id":"4a7cccb5-cfad-4692-a822-d6b665132ee2","resolution":{"observed_at":"2026-08-07T00:13:05.129591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15098","last_updated":"2025-07-07T17:33:23Z","snapshot_observed_at":"2026-07-06T19:55:37.400185Z","submitted_at":"2024-11-22T17:55:15Z","title":"OminiControl: Minimal and Universal Control for Diffusion Transformer","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15098","snapshot_observed_at":"2026-08-07T00:13:04.489460Z","title":"Ominicontrol: Minimal and universal control for diffusion transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.489460Z"},"links":{"cited_paper":"/paper/2411.15098","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:1d7e6082e65d35b78c794b667227b1b537165a15c65d55c9d483e8edb4fd2d5c","observation_id":"ede8d7df-20ea-42e3-9be4-d8f5378ebb9c","resolution":{"observed_at":"2026-08-07T00:13:04.489460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00086","last_updated":"2024-11-05T12:25:32Z","snapshot_observed_at":"2026-07-06T19:24:48.032228Z","submitted_at":"2024-09-30T17:56:27Z","title":"ACE: All-round Creator and Editor Following Instructions via Diffusion Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00086","snapshot_observed_at":"2026-08-07T00:13:04.493186Z","title":"Ace: All-round creator and editor following instructions via diffusion transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.493186Z"},"links":{"cited_paper":"/paper/2410.00086","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:4805476836023a65615ffe4500150ab7b922972b1c496267da9d3f0c8053fb27","observation_id":"f0377468-934e-4b4b-96a0-ab005b44fbd9","resolution":{"observed_at":"2026-08-07T00:13:04.493186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04903","last_updated":"2025-04-08T07:26:50Z","snapshot_observed_at":"2026-08-07T16:08:03.488421Z","submitted_at":"2025-04-07T10:22:00Z","title":"Lumina-OmniLV: A Unified Multimodal Framework for General Low-Level Vision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04903","snapshot_observed_at":"2026-08-07T00:13:04.497133Z","title":"Lumina-omnilv: A unified multimodal framework for general low-level vision","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.497133Z"},"links":{"cited_paper":"/paper/2504.04903","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:3a1c26dcc145a23be77818ae624d3d477c51c98cd9e638dff3b8039be21f92f2","observation_id":"53691e83-f519-4e0e-b813-5b59bb0ec8c6","resolution":{"observed_at":"2026-08-07T00:13:04.497133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04145","last_updated":"2023-11-07T17:16:06Z","snapshot_observed_at":"2026-08-02T12:25:34.488259Z","submitted_at":"2023-11-07T17:16:06Z","title":"I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04145","snapshot_observed_at":"2026-08-07T00:13:04.500438Z","title":"I2vgen-xl: High-quality image-to-video synthesis via cascaded diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.500438Z"},"links":{"cited_paper":"/paper/2311.04145","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:75b5b1af1831b28b0ca513cbe922e1b9f13bd9d5077aab8e39860b933d9e35c8","observation_id":"2c62ed5c-f1ec-4326-926e-dbef69feb33c","resolution":{"observed_at":"2026-08-07T00:13:04.500438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-07T00:13:04.504267Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.504267Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:b40b8bda6dfc249111e2e71aba9b4c8ec68dfb675e4eed2f528ad99044b410c0","observation_id":"333320b0-59a4-4c1b-a6aa-5baaec22d8e9","resolution":{"observed_at":"2026-08-07T00:13:04.504267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.116389Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"d572d9af-6403-4885-81a7-905e03ae309b","year":2021},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.508043Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:ff9ca03d53bf6fad5e14994cabc4633b1d02c64e3d601b4e76813cd3691c94f5","observation_id":"17e2967b-be87-45ed-bcf8-61ca542a39f8","resolution":{"observed_at":"2026-08-07T00:13:05.119747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-07T00:13:04.511542Z","title":"Ip-adapter: Text compatible image prompt adapter for text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.511542Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:37fed5fbf8070612aab313dfedb54e7aa4fd53e0411bf9bd9d18c8e163600ac2","observation_id":"c96f2ad6-fb2e-47f0-912c-9fc53f4c6704","resolution":{"observed_at":"2026-08-07T00:13:04.511542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19680","last_updated":"2025-06-27T10:06:13Z","snapshot_observed_at":"2026-08-04T16:03:06.733403Z","submitted_at":"2024-06-28T06:40:53Z","title":"MimicMotion: High-Quality Human Motion Video Generation with Confidence-aware Pose Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19680","snapshot_observed_at":"2026-08-07T00:13:04.515424Z","title":"Mimicmotion: High-quality human motion video generation with confidence-aware pose guidance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.515424Z"},"links":{"cited_paper":"/paper/2406.19680","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:7ffd50fe9a417f87deda7839be2245916004b666dbb1ee004fd0479a6287f940","observation_id":"908a6b4c-eabd-4aaf-a2d4-2bdbf6fa9b09","resolution":{"observed_at":"2026-08-07T00:13:04.515424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09349","last_updated":"2025-02-25T02:55:40Z","snapshot_observed_at":"2026-07-06T20:06:00.411620Z","submitted_at":"2024-12-12T15:15:59Z","title":"DisPose: Disentangling Pose Guidance for Controllable Human Image Animation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09349","snapshot_observed_at":"2026-08-07T00:13:04.519102Z","title":"Dispose: Disentangling pose guidance for controllable human image animation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.519102Z"},"links":{"cited_paper":"/paper/2412.09349","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:b4c925e8420932650530e890f1213370ddfb54a23f2efee26ac6b47a6a986739","observation_id":"1ae45969-d19c-4b62-ac36-bb9edf064ec5","resolution":{"observed_at":"2026-08-07T00:13:04.519102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.106448Z","title":"Animateanyone: Consistent human motion transfer in realistic videos","venue":null,"work_id":"1eb411ae-c770-4cf8-a35a-497c9972f5b4","year":2024},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.522868Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:8647c7fb91b1cc6e2a50e7ac35ed515c014a9aba6bc7f198b927616c1a996bbb","observation_id":"5c36e8a4-903f-4c12-8d85-ec5651b9d771","resolution":{"observed_at":"2026-08-07T00:13:05.110091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.095346Z","title":"Magicanimate: Temporally consistent human image animation using diffusion model","venue":null,"work_id":"c061dd29-010c-4d5b-a021-b1cf1db00b86","year":2023},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.526915Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:09b1a4661662b0101e6e96840d160ac4ad711141dc2a47f18608e57aa9c1c718","observation_id":"adb6650d-7918-4b07-8f02-27dc86999706","resolution":{"observed_at":"2026-08-07T00:13:05.099190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.083987Z","title":"Learning high fidelity depths of dressed humans by watching social media dance videos","venue":null,"work_id":"d3759118-41c1-4484-8379-f5cc4a79d68b","year":2021},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.530706Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:383d2ac6bd2d8b39175dc5fdceabde09388d6cfcf9b9c0bf1f2a34575356ec76","observation_id":"7ca5358f-a765-4aa5-ac72-afca62bb32ca","resolution":{"observed_at":"2026-08-07T00:13:05.087511Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.072849Z","title":"15 Figure 5: Showcase of our FramePrompt approach generating diverse animations from the TikTok dataset","venue":null,"work_id":"c78fa9d4-54ff-4a61-aec8-1e0b566b78fb","year":null},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.534593Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:b2a25a31f1f286dff0615094ff7480fef7a79c7004ca910e615c50f4d3be312a","observation_id":"de37819b-faba-428d-882e-bc9125cd6a14","resolution":{"observed_at":"2026-08-07T00:13:05.076704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.062120Z","title":null,"venue":null,"work_id":"739d48fc-6924-402a-abaf-c26e275d2b19","year":null},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.538458Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:3a240083328bc3b4dd662322f01af24efb3ddf768241270b6d0591cef1e03709","observation_id":"8c9a9188-9304-441b-bd2e-b17d13e5b5ce","resolution":{"observed_at":"2026-08-07T00:13:05.065309Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.051457Z","title":null,"venue":null,"work_id":"e5e9adb6-34e9-490d-8915-728847ac7124","year":null},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.542241Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:67b103e601b8d086ba7c77a7b04e5518f6c6e90ffa7a6f8098b6ec8bd93a52df","observation_id":"77f02d32-b4e5-4df5-bd64-55e7d683f121","resolution":{"observed_at":"2026-08-07T00:13:05.055105Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:05.038193Z","title":"These visual results complement our quantitative findings, providing concrete evidence of our method’s effectiveness in generating high-quality character animations","venue":null,"work_id":"a932a91d-9e4f-4900-849a-67001204ef02","year":null},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.545571Z"},"links":{"citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:d92efdb8dc1b01f9568008f3c0477669198536bef87d014107a3fa1b88f8e66e","observation_id":"832377cb-51a1-40b1-bf26-1c8338d05eca","resolution":{"observed_at":"2026-08-07T00:13:05.044186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","latest_version":2,"primary_category":"cs.GR","snapshot_observed_at":"2026-08-07T00:07:19.564751Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 1 inbound Pith citation observation for arXiv:2506.17301."}