{"as_of":"2026-08-13T16:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:504300b063ecdddc43ab7673d1b66bdeb09ad7471d2a5134c575dd294df2bf21","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T19:18:52.844859Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:07:39.636266Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T15:20:00.775292Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10836","snapshot_observed_at":"2026-08-12T11:07:39.636266Z","title":"Animateanything: Consistent and con- trollable animation for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18673","last_updated":"2025-05-06T13:11:14Z","snapshot_observed_at":"2026-08-12T11:10:08.899344Z","submitted_at":"2024-11-27T18:49:13Z","title":"AC3D: Analyzing and Improving 3D Camera Control in Video Diffusion Transformers","version":4},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T11:07:39.636266Z"},"links":{"cited_paper":"/paper/2411.10836","citing_paper":"/paper/2411.18673"},"observation_digest":"sha256:2cf168fd3788bd123f662eac5bab2d1d4dd72d2f736f6f337ec1b4a3b7c2b194","observation_id":"12c83859-a71d-487d-93a9-a745ad826b9d","resolution":{"observed_at":"2026-08-12T11:07:39.636266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10836","snapshot_observed_at":"2026-08-10T21:25:45.808653Z","title":"Animateanything: Consistent and con- trollable animation for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.05020","last_updated":"2025-03-10T10:46:31Z","snapshot_observed_at":"2026-08-11T01:07:29.677090Z","submitted_at":"2025-01-09T07:23:48Z","title":"Perception-as-Control: Fine-grained Controllable Image Animation with 3D-aware Motion Representation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T21:25:45.808653Z"},"links":{"cited_paper":"/paper/2411.10836","citing_paper":"/paper/2501.05020"},"observation_digest":"sha256:c169e6b7f17cf152cfa1f010eb83ca60e5f189214a872539d5704a6ca8879cec","observation_id":"9c28bcb4-8828-49be-8a05-5624b5d1085e","resolution":{"observed_at":"2026-08-10T21:25:45.808653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10836","snapshot_observed_at":"2026-08-10T16:12:00.069165Z","title":"Animateanything: Consistent and controllable animation for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13452","last_updated":"2025-02-27T06:55:41Z","snapshot_observed_at":"2026-08-10T20:06:28.437472Z","submitted_at":"2025-01-23T08:06:11Z","title":"EchoVideo: Identity-Preserving Human Video Generation by Multimodal Feature Fusion","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T16:12:00.069165Z"},"links":{"cited_paper":"/paper/2411.10836","citing_paper":"/paper/2501.13452"},"observation_digest":"sha256:56a875f5ea961584b7cf408b3cc10b5bf4e3c3db21a39ea41e201d34a083e038","observation_id":"385aff47-7303-4567-8bf9-0c25f0c595b0","resolution":{"observed_at":"2026-08-10T16:12:00.069165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10836","snapshot_observed_at":"2026-08-08T17:13:02.771293Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05979","last_updated":"2025-04-01T07:54:57Z","snapshot_observed_at":"2026-08-13T10:18:21.690566Z","submitted_at":"2025-02-09T18:12:25Z","title":"VFX Creator: Animated Visual Effect Generation with Controllable Diffusion Transformer","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:02.771293Z"},"links":{"cited_paper":"/paper/2411.10836","citing_paper":"/paper/2502.05979"},"observation_digest":"sha256:806293b5ce3d3f0a484081129124628ce58ca08fafc283e16179c978ac780d04","observation_id":"eac7b07d-8dc9-4c16-8c39-12db6a530204","resolution":{"observed_at":"2026-08-08T17:13:02.771293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10836","snapshot_observed_at":"2026-08-07T14:01:10.346244Z","title":"Animateanything: Consistent and con- trollable animation for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20255","last_updated":"2025-07-07T17:56:30Z","snapshot_observed_at":"2026-08-12T02:55:15.853506Z","submitted_at":"2025-05-26T17:32:10Z","title":"AniCrafter: Customizing Realistic Human-Centric Animation via Avatar-Background Conditioning in Video Diffusion Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:10.346244Z"},"links":{"cited_paper":"/paper/2411.10836","citing_paper":"/paper/2505.20255"},"observation_digest":"sha256:a03697f24128125cbd14736d2a3c33f7cd2556c099ca4ff6be5d066a73f180e9","observation_id":"652d223a-549f-4908-932d-26291ae17ad5","resolution":{"observed_at":"2026-08-07T14:01:10.346244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"cited_work":{"arxiv_id":"2411.10836","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10836","snapshot_observed_at":"2026-08-06T15:20:00.775292Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","venue":"cs.CV","work_id":"02f416cb-d24f-44ad-b8b4-7ab1e8b84f01","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-12T18:39:33.934732Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.210090Z"},"links":{"cited_paper":"/paper/2411.10836","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:c520da6a3880514d12c07867ca787b2fdeb65021e4eddc9a16ea1994692c78c6","observation_id":"1ca179f3-3f28-4ced-86d1-326e20dfe177","resolution":{"observed_at":"2026-08-06T15:20:00.783634Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10836","snapshot_observed_at":"2026-08-03T03:17:55.578984Z","title":"arXiv preprint arXiv:2411.10836 (2024) 4 18 Songchun Zhang et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29627","last_updated":"2026-07-31T16:59:46Z","snapshot_observed_at":"2026-08-05T23:16:09.548439Z","submitted_at":"2026-07-31T16:59:46Z","title":"FlexComposer: Unified Video Compositing from Images to Dynamic Footage with Flexible Trajectory Control","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T03:17:55.578984Z"},"links":{"cited_paper":"/paper/2411.10836","citing_paper":"/paper/2607.29627"},"observation_digest":"sha256:95d8b7d3f78552ff0ecb79a9d0a096192ddcfdfc9c8cfdf6156572e35cf8f0e8","observation_id":"05cc9ba0-52d3-4b2b-9a55-bf5c5955b1b2","resolution":{"observed_at":"2026-08-03T03:17:55.578984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.10836/citation-record","integrity":"/paper/2411.10836/integrity","json":"/paper/2411.10836/citation-record.json","paper":"/paper/2411.10836"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T19:18:52.574139Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.574139Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:6555d87e22f2c2739340c2ed807c517319f358ca3881b10a76344c0d2fe51cc5","observation_id":"d730624a-3fa1-4d9c-ac41-c09705dd96f1","resolution":{"observed_at":"2026-08-12T19:18:52.574139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-12T23:20:07.594666Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-12T19:18:52.579201Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.579201Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:905adcac299859fe14fca1a36506d1fe79e9e6b9148c279037c519f3819af8d1","observation_id":"a2aa6859-8b5b-4edd-95e4-c1f698527331","resolution":{"observed_at":"2026-08-12T19:18:52.579201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.648628Z","title":"Frozen in time: A joint video and image encoder for end-to-end retrieval","venue":null,"work_id":"111d4a30-56f2-489f-bd67-2f1c07bc1127","year":2021},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.586140Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:a688eb6a8f71b7819750779adebbe37160e94ab2683147844011d0e7999bd3a5","observation_id":"c95cdddd-f30b-4d71-b289-0d8b97f4de3b","resolution":{"observed_at":"2026-08-12T19:18:53.653578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.635731Z","title":"Frozen in time: A joint video and image encoder for end-to-end retrieval","venue":null,"work_id":"432bc65c-7f6d-44ed-bab0-4818a2fab934","year":2021},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.590400Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:56c765a4285e9f162871ac155ad102cbea9dfdb626e01ca86b070e29c6a3ca32","observation_id":"ff265f0b-7b8e-4f3c-bc3b-de53093e0519","resolution":{"observed_at":"2026-08-12T19:18:53.640085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:52.595069Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.595069Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:0a20c0dc9d187873124e50812b8fa85e0ba4bb175d4d9653b3f54fbc0d29bdda","observation_id":"bdd1d13b-a779-4d52-bb9a-a27f7cc7cacb","resolution":{"observed_at":"2026-08-12T19:18:52.595069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.616546Z","title":"Generative rendering: Controllable 4d-guided video generation with 2d diffusion models","venue":null,"work_id":"ecacdad6-19ef-408b-b5df-0ee5dc1e50f2","year":2023},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.599176Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:2ca00b4cd46606ec88a3e7075907e505ce8f822d82867c193e8a6bce01b7d0c8","observation_id":"b9b02cf7-8618-4122-853d-3f68bae81508","resolution":{"observed_at":"2026-08-12T19:18:53.620659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.604220Z","title":"Diffdreamer: Towards consistent unsupervised single-view scene extrapolation with conditional diffusion models","venue":null,"work_id":"28f90f2c-748f-4364-9715-1f87d9f7845b","year":2023},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.603323Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:856078b2fb900be34cd2ce3a5fe3ee3d8d8568d8c7a7762f165ca579bbe0a543","observation_id":"3a56f7da-c31f-42a7-a8bb-373d8661dd4d","resolution":{"observed_at":"2026-08-12T19:18:53.608081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.593255Z","title":"Pix2video: Video editing using image diffusion","venue":null,"work_id":"8865ccbf-e6f9-4233-a63f-b465fba25d84","year":null},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.608270Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:90cdb468df95d322d94c5660ead8df50d2285420b4d81d66eb19f194a9238931","observation_id":"18885287-be1f-4b3f-ba56-fa7a0cd28d4a","resolution":{"observed_at":"2026-08-12T19:18:53.597125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.580586Z","title":"Sound2sight: Gen- erating visual dynamics from sound and context","venue":null,"work_id":"d1666e11-2f81-45eb-a933-6eb46a6cd8a0","year":null},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.611919Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:abcd1e113e6811812d0e42d28899c2e278642060c800085157e4ab6970c57b7e","observation_id":"fbe643f2-ab62-4a6c-ad08-58dd58c5bb3c","resolution":{"observed_at":"2026-08-12T19:18:53.584785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:52.615845Z","title":"Seine: Short-to-long video diffusion model for generative transition and prediction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.615845Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:193814e9ade4d29705487e14a3b6caf855e3274aea999529b592b8362c566c34","observation_id":"f7847088-98e7-49dd-8c9b-f749cbecd5e3","resolution":{"observed_at":"2026-08-12T19:18:52.615845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.560941Z","title":"His- torical notes on the fast fourier transform.Proceedings of the IEEE, 55(10):1675–1677, 1967","venue":null,"work_id":"078403f9-04ef-4d5c-ace6-de445ee0a28f","year":1967},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.620381Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:b0d9fe897567ad3afa3e5b8d6e478d7fd9f91234953edb9a03ead7d6a559a2b1","observation_id":"f9c179f3-dea1-4fc2-bf57-56d1c2cd772d","resolution":{"observed_at":"2026-08-12T19:18:53.565441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.549336Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"0fcaf265-49a4-4704-9627-b8444683c26d","year":2021},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.624695Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:24570b29b3880c245079f6a8e1c90b8f46331363737d043e34995dee8f354370","observation_id":"a98a35be-3570-495b-bdaa-250e2cfd73b2","resolution":{"observed_at":"2026-08-12T19:18:53.553453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.537571Z","title":"Structure and content-guided video synthesis with diffusion models","venue":null,"work_id":"0e2780da-9eba-4714-aa07-91d341b48aa4","year":2023},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.628705Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:1b0089d486421a2fb77303cc67ee35a5f33ba095fb75b143a6e1a56854b379a7","observation_id":"460f04a0-d8da-4768-8e90-b940f3f90c3e","resolution":{"observed_at":"2026-08-12T19:18:53.541512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14709","last_updated":"2024-05-28T09:07:34Z","snapshot_observed_at":"2026-08-12T23:59:42.075930Z","submitted_at":"2024-05-23T15:42:34Z","title":"OpFlowTalker: Realistic and Natural Talking Face Generation via Optical Flow Guidance","version":2},"cited_work":{"arxiv_id":"2405.14709","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.14709","snapshot_observed_at":"2026-08-12T19:18:53.119170Z","title":"OpFlowTalker: Realistic and Natural Talking Face Generation via Optical Flow Guidance","venue":"cs.CV","work_id":"5fe9c1fe-c01e-453c-ae71-69f56125dcfb","year":2024},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.632824Z"},"links":{"cited_paper":"/paper/2405.14709","citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:740af8cdfbf5d3dc6f8d24997441b5e4d6283546ddd17f05c530966da0acb9ac","observation_id":"835fe0c8-70d6-4c1b-947d-95d1bb44a5ac","resolution":{"observed_at":"2026-08-12T19:18:53.125496Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.521738Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning","venue":null,"work_id":"772957a5-3294-40af-a023-67870a95866c","year":2023},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.637776Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:79b4b220acc9164158216d8cbabd2cfa432df3385be04c48c76f515a4fdf4910","observation_id":"ba1bd5e3-7171-4458-b7a8-aa95b26ecb2a","resolution":{"observed_at":"2026-08-12T19:18:53.526052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.508217Z","title":"Controllable video generation with sparse trajectories","venue":null,"work_id":"ea761edc-105c-4837-bd47-1e496f5e59e8","year":2018},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.642758Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:7c2dda12f75142e9dfcaa2595eee4fa223c4738e79a6cd126cc568985a3648cb","observation_id":"db2506b2-4e1e-4b1c-a20c-b56ca9a504a5","resolution":{"observed_at":"2026-08-12T19:18:53.512536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-08-12T01:27:32.593496Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-08-12T19:18:52.647903Z","title":"Camerac- trl: Enabling camera control for text-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.647903Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:a30564ed0781062799f6aee6852d7893202f8e9e318be114d3c4de80a6368ead","observation_id":"9fd0be32-8ba8-4ef8-a46d-5d116dfd2d1a","resolution":{"observed_at":"2026-08-12T19:18:52.647903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:52.652002Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.652002Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:eb7de0c4cdc808f81cb85db8397c34cbf07c21c74b5976e2c4ede2b761876a77","observation_id":"ca09c67e-aec8-407e-aca5-4076ade541d9","resolution":{"observed_at":"2026-08-12T19:18:52.652002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15868","last_updated":"2022-05-29T19:02:15Z","snapshot_observed_at":"2026-08-12T19:21:15.526321Z","submitted_at":"2022-05-29T19:02:15Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15868","snapshot_observed_at":"2026-08-12T19:18:52.655707Z","title":"Cogvideo: Large-scale pretraining for text-to-video generation via transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.655707Z"},"links":{"cited_paper":"/paper/2205.15868","citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:7efc19932fcb713daca23002e87815ab65c0555b0a0a5278021d2985f9868526","observation_id":"b0cb156e-efbb-43f1-a57d-1d27de59fa81","resolution":{"observed_at":"2026-08-12T19:18:52.655707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.488425Z","title":"Image quality metrics: Psnr vs","venue":null,"work_id":"640e4990-b5b7-4c6b-8d71-5ebde4835312","year":2010},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.659805Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:ceaac30d827f53c6ed92bc1015c11c9f3aab0393e1bce8fba0c6d6a55fa08424","observation_id":"951c40c7-1704-4358-90ba-9fc1e3f686a1","resolution":{"observed_at":"2026-08-12T19:18:53.492539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-12T19:18:52.663924Z","title":"Lora: Low-rank adaptation of large language mod- els","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.663924Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:ec8fa21285dafa3e14966b92de7089fe4745fc4932b5145d02ca5909c5f4ed01","observation_id":"4462d2db-867c-4996-a69c-3852c3c3f973","resolution":{"observed_at":"2026-08-12T19:18:52.663924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17117","last_updated":"2024-06-13T06:37:20Z","snapshot_observed_at":"2026-08-13T05:15:29.772394Z","submitted_at":"2023-11-28T12:27:15Z","title":"Animate Anyone: Consistent and Controllable Image-to-Video Synthesis for Character Animation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17117","snapshot_observed_at":"2026-08-12T19:18:52.668061Z","title":"Animate anyone: Consistent and con- trollable image-to-video synthesis for character animation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.668061Z"},"links":{"cited_paper":"/paper/2311.17117","citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:07b22b62750b77ecc69955ee2904a37d4a2c32a10fd26a07a95ca27b11308eed","observation_id":"5d2dc065-227b-4916-adaf-b4ac4bed1c18","resolution":{"observed_at":"2026-08-12T19:18:52.668061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:52.671940Z","title":"VBench: Com- prehensive benchmark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.671940Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:3e659491e072a021087c4ba990bc91583ecfaf05ff0e84b12e3c5669bdb71f11","observation_id":"b57532e1-a41c-411c-912e-595741be6698","resolution":{"observed_at":"2026-08-12T19:18:52.671940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.469056Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":"14c9880e-3c98-4044-bed5-c84bb4f88066","year":null},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.676288Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:44ed9cefad7bf3d211b1c7288b7c624ee7699b989d93190bb435916741e87e11","observation_id":"232f0e2e-1bae-4f6e-95f2-d48ec87f00e8","resolution":{"observed_at":"2026-08-12T19:18:53.473599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.457055Z","title":"Peekaboo: Interactive video generation via masked- diffusion","venue":null,"work_id":"e1c30236-bde7-44e2-8994-b701524e1495","year":2024},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.680097Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:06e3f7356a945b60b322484f76280afa774859f4f061c11b68350259dffc2194","observation_id":"b7e85aef-b471-43a4-bab7-f9314e3d9cba","resolution":{"observed_at":"2026-08-12T19:18:53.461124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:52.684162Z","title":"Pyramidal flow matching for effi- cient video generative modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.684162Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:ded0384db91dd3a4e07397b2ae9fa0eb031ffaba560d38b7fed1eb7f86bf4b1c","observation_id":"8c2e7887-9c53-4395-9d89-4ee29b5be0e0","resolution":{"observed_at":"2026-08-12T19:18:52.684162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.445172Z","title":"Text2video-zero: Text- to-image diffusion models are zero-shot video generators","venue":null,"work_id":"486b2dd3-955b-4752-b3e7-59bb384e1e2a","year":2023},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.689081Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:b03b03be49ded1b1671ddf2dff9942f133d92817beb20a7273e208d712aecfbd","observation_id":"9910865c-c2ea-4df5-9def-8fff18e59614","resolution":{"observed_at":"2026-08-12T19:18:53.449398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.432547Z","title":"Dl3dv-10k: A large-scale scene dataset for deep learning-based 3d vision","venue":null,"work_id":"86131c78-952a-4cdc-9d56-bc0c22bd38d5","year":2024},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.693406Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:06c0c6d3d8677c0b4029e2f5c5134fcc50a492d47e7246e54800cea6b96da02e","observation_id":"4afa8a55-087a-4cfc-8b0a-b65875802f14","resolution":{"observed_at":"2026-08-12T19:18:53.436660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05338","last_updated":"2024-10-22T04:22:16Z","snapshot_observed_at":"2026-08-12T23:47:28.499464Z","submitted_at":"2024-06-08T03:44:25Z","title":"MotionClone: Training-Free Motion Cloning for Controllable Video Generation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05338","snapshot_observed_at":"2026-08-12T19:18:52.697634Z","title":"Motionclone: Training-free motion cloning for controllable video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.697634Z"},"links":{"cited_paper":"/paper/2406.05338","citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:5afbd04885b25b35af7201b7226ad78d6db7a3567009460db2a5fdf44c842520","observation_id":"83c9dc98-62a2-43df-be60-725da56eb945","resolution":{"observed_at":"2026-08-12T19:18:52.697634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02371","last_updated":"2025-02-13T10:13:24Z","snapshot_observed_at":"2026-08-07T10:03:56.902190Z","submitted_at":"2024-07-02T15:40:29Z","title":"OpenVid-1M: A Large-Scale High-Quality Dataset for Text-to-video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02371","snapshot_observed_at":"2026-08-12T19:18:52.701810Z","title":"Openvid-1m: A large-scale high-quality dataset for text-to- video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.701810Z"},"links":{"cited_paper":"/paper/2407.02371","citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:bcd9460a5c3c82d39278c8b2c8b227efb96cdfaaeec71a4380e3c184efb2ec48","observation_id":"5855add1-3d28-4e64-8377-df71e3e1c877","resolution":{"observed_at":"2026-08-12T19:18:52.701810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20222","last_updated":"2024-07-11T16:26:03Z","snapshot_observed_at":"2026-08-12T23:54:01.281719Z","submitted_at":"2024-05-30T16:22:22Z","title":"MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20222","snapshot_observed_at":"2026-08-12T19:18:52.706131Z","title":"Mofa-video: Controllable image animation via generative motion field adaptions in frozen image-to-video diffusion model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.706131Z"},"links":{"cited_paper":"/paper/2405.20222","citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:0fcbdb6a2a8411f28d647bb7b27aa4b61213257e14ee839d67aabdd554cb4fd0","observation_id":"21ae469d-1ce4-45e8-9e0e-e2d9f5b26820","resolution":{"observed_at":"2026-08-12T19:18:52.706131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:52.711281Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.711281Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:3436ccd36fc752ff4d1fb05a6cd399d2432453d2ef4a4d5668f84a5a4debe57d","observation_id":"6bbbb237-5b39-4eb7-972a-acf7b36e0fe2","resolution":{"observed_at":"2026-08-12T19:18:52.711281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17189","last_updated":"2022-03-31T17:12:13Z","snapshot_observed_at":"2026-08-13T16:10:46.515920Z","submitted_at":"2022-03-31T17:12:13Z","title":"Scaling Up Models and Data with $\\texttt{t5x}$ and $\\texttt{seqio}$","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17189","snapshot_observed_at":"2026-08-12T19:18:52.716423Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.716423Z"},"links":{"cited_paper":"/paper/2203.17189","citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:497c363df83e8f097dfc9c246f0b5f0a3ea74d43b59880fd4737beb08b881b54","observation_id":"4d23d84d-3454-4530-8df6-96a953bf7345","resolution":{"observed_at":"2026-08-12T19:18:52.716423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.410391Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"91397d93-785c-49a1-b6db-0370bda767c8","year":2022},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.720895Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:69f8f09109bcc73fdd3c8b2f5ae899cd0a7ca14ab7728c4492c5d6eef1e7fcd6","observation_id":"a8f61e93-1e5d-49d7-8f5b-bb689c9bba4d","resolution":{"observed_at":"2026-08-12T19:18:53.415203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.397096Z","title":"U- net: Convolutional networks for biomedical image segmen- tation","venue":null,"work_id":"67838a07-f572-45b0-9025-a64653fad87b","year":2015},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.725169Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:2160a25c57627e9e688df2afbe4c109fcbc7e76b7cd815ab1c6df736ea14ba7a","observation_id":"2c56de15-a799-4fd9-afc1-2b47997d687d","resolution":{"observed_at":"2026-08-12T19:18:53.401351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10792","last_updated":"2024-10-14T17:56:24Z","snapshot_observed_at":"2026-08-13T10:37:03.105354Z","submitted_at":"2024-10-14T17:56:24Z","title":"Semantic Image Inversion and Editing using Rectified Stochastic Differential Equations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10792","snapshot_observed_at":"2026-08-12T19:18:52.729422Z","title":"Semantic image inversion and editing using rectified stochastic differential equations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.729422Z"},"links":{"cited_paper":"/paper/2410.10792","citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:eab00043ddc28116ef49bbb3f20e3a12819cb9751e7569a0f92bdaa66c799619","observation_id":"e26a5c72-9bea-46c1-9761-994592fac137","resolution":{"observed_at":"2026-08-12T19:18:52.729422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.384243Z","title":"Schonberger and Jan-Michael Frahm","venue":null,"work_id":"0e4903ce-2c19-409a-897b-bdfb20e18ba0","year":2016},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.734050Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:cf3485314994d616a4c3a044d226df04be7c03896fce65762c448628c30e4990","observation_id":"214e9096-6b35-4ac1-9243-73fb27e33513","resolution":{"observed_at":"2026-08-12T19:18:53.388326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.372396Z","title":"Motion-i2v: Consistent and controllable image-to-video generation with explicit motion modeling","venue":null,"work_id":"f083b38c-b5c5-46f2-b206-d981eba32cc7","year":null},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.738682Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:e6d39619f89f03c12b7076786f7285fa7fc56d277e57b614c6836dd95c421da4","observation_id":"cabc1012-02c3-4996-82b4-209350392925","resolution":{"observed_at":"2026-08-12T19:18:53.376624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.359357Z","title":"Light field networks: Neu- ral scene representations with single-evaluation rendering","venue":null,"work_id":"a25d1268-3385-402e-be35-48ee8cc681b3","year":2021},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.742547Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:4df4c0dfedf65078818e1ed1e751ded633218f2ca8b16c763ca836b4d0287766","observation_id":"c673dcc8-14fa-4c54-9beb-80e59b28b48b","resolution":{"observed_at":"2026-08-12T19:18:53.363693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14207","last_updated":"2024-03-12T15:40:08Z","snapshot_observed_at":"2026-08-13T12:17:30.078957Z","submitted_at":"2023-03-24T18:00:15Z","title":"DiffuScene: Denoising Diffusion Models for Generative Indoor Scene Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14207","snapshot_observed_at":"2026-08-12T19:18:52.746018Z","title":"To- wards accurate generative models of video: A new metric & challenges","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.746018Z"},"links":{"cited_paper":"/paper/2303.14207","citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:433ba3dafa0a09f46806c95a229286eca7a95d3d478a61a98b2fa778722a5b48","observation_id":"6840aa04-e808-4fa1-a02e-ae388fb4adb6","resolution":{"observed_at":"2026-08-12T19:18:52.746018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.347670Z","title":"Vggsfm: Visual geometry grounded deep structure from motion","venue":null,"work_id":"3adc1d3c-bbf4-4823-a52d-864d647250ee","year":2024},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.750918Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:b68c093e5dc68b26fc1b4af6f539195f4c07fc1dab88ea255e6ee411eff84a7e","observation_id":"1fbdae2e-7022-4125-a17c-cad6d4145c99","resolution":{"observed_at":"2026-08-12T19:18:53.351710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:52.755269Z","title":"Dust3r: Geometric 3d vi- sion made easy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.755269Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:a04996d86acf1efa508d47468c05d0f195ca25fe1d4ca9c4a1537af79ef09712","observation_id":"7be1fd27-a34c-4d1c-9888-25486fde6198","resolution":{"observed_at":"2026-08-12T19:18:52.755269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.326407Z","title":"Videocomposer: Compositional video synthesis with motion controllability","venue":null,"work_id":"b0f16a41-e65f-4df5-b2a8-08ff24881477","year":2024},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.760060Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:f93c29ec2c3b48f329fec5d86832b6249916aa8086e7ac09c4b8c02384cf4170","observation_id":"85164d53-071a-4cfd-83d9-cfa6b2df7135","resolution":{"observed_at":"2026-08-12T19:18:53.330442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.314731Z","title":"Wang, A.C","venue":null,"work_id":"70242654-86cc-4f51-b320-edebb8bfe70d","year":2004},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.764043Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:129faf51c0a4aa833d7ca46671c383c8d6d67a0574f70006feac2daffae98f85","observation_id":"ed883dd0-0e19-46fa-9f35-7d262a4209ee","resolution":{"observed_at":"2026-08-12T19:18:53.318398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.301364Z","title":"Motionctrl: A unified and flexible motion controller for video generation","venue":null,"work_id":"53777d53-c9e7-49b7-87c4-f121291ff38d","year":2024},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.767802Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:48cedb7a0192399d78df9f9993d2c3697e7e9f3f69cd98464780525298e227fb","observation_id":"e19affd6-749a-4889-bf95-cfd28ce5ef28","resolution":{"observed_at":"2026-08-12T19:18:53.306282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.289358Z","title":"Tune-a-video: One-shot tuning of im- age diffusion models for text-to-video generation","venue":null,"work_id":"f1394abc-8345-460e-aa99-b29c57cb59b2","year":null},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.771541Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:25cc405d095eba946505018c5e1480459d06fe204bb5e5b9fb574efde6af1b58","observation_id":"ffac9d4c-5b1a-49b1-a650-d02e99bc49c3","resolution":{"observed_at":"2026-08-12T19:18:53.293383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.276144Z","title":"Draganything: Motion control for any- thing using entity representation","venue":null,"work_id":"e31bf0e9-60ad-470b-9b6a-ff6fe072b938","year":2024},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.775439Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:abdef4326d2412f2889f2815bf6e50ddb2dc305cea66fa34880886be06966fcb","observation_id":"c9f4b2ab-9c7c-4455-bed4-89581883ec7c","resolution":{"observed_at":"2026-08-12T19:18:53.280479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12190","last_updated":"2023-11-27T13:36:04Z","snapshot_observed_at":"2026-08-13T05:46:49.160520Z","submitted_at":"2023-10-18T14:42:16Z","title":"DynamiCrafter: Animating Open-domain Images with Video Diffusion Priors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12190","snapshot_observed_at":"2026-08-12T19:18:52.780183Z","title":"Dynamicrafter: Animating open-domain im- ages with video diffusion priors","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.780183Z"},"links":{"cited_paper":"/paper/2310.12190","citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:010a72fa105a71d424a3766b72efe4cf78c06e0638ddf9817ab730d5dc8b75a3","observation_id":"8f66383c-37d4-436e-ad7c-090dac3bfd46","resolution":{"observed_at":"2026-08-12T19:18:52.780183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02509","last_updated":"2024-06-04T17:27:19Z","snapshot_observed_at":"2026-08-04T13:02:12.217544Z","submitted_at":"2024-06-04T17:27:19Z","title":"CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02509","snapshot_observed_at":"2026-08-12T19:18:52.784912Z","title":"Camco: Camera- controllable 3d-consistent image-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.784912Z"},"links":{"cited_paper":"/paper/2406.02509","citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:9e0f3a265dad10b9c8dbc986a008cf2bcf1f0258be292105912f8253214e36b4","observation_id":"75306f30-ea42-47ed-ac0e-d40d0de69864","resolution":{"observed_at":"2026-08-12T19:18:52.784912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.262765Z","title":"Unifying flow, stereo and depth estimation","venue":null,"work_id":"352cbf62-29e3-4e5d-91d2-f8f5b8405355","year":2023},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.789066Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:bfb7df7682c40ecc83a81ea89b75885c0b415e14039a34c801eb9168e2235ba6","observation_id":"600ea155-944e-49ac-9e61-bdd086089ec9","resolution":{"observed_at":"2026-08-12T19:18:53.266676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-12T19:18:52.793347Z","title":"Cogvideox: Text-to-video diffu- sion models with an expert transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.793347Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:0700c7f268e559e285724668f56ed73206323b2e8b4bfc4ee21ab05d1aef370e","observation_id":"b6a4d089-c73a-4460-9a75-5cf3919eea27","resolution":{"observed_at":"2026-08-12T19:18:52.793347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.251300Z","title":"Focusflow: Boosting key-points optical flow estimation for autonomous driving","venue":null,"work_id":"3c61354e-202f-4b1b-8422-b8b65d726f31","year":2023},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.797960Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:374317e3aec250d04883a7f348273f1988ad2289fb86e03c02a8769b2e6f23c8","observation_id":"167638ae-3aa9-45d9-ab43-02eb0d66db2b","resolution":{"observed_at":"2026-08-12T19:18:53.255371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08089","last_updated":"2023-08-16T01:43:41Z","snapshot_observed_at":"2026-07-06T16:06:38.424057Z","submitted_at":"2023-08-16T01:43:41Z","title":"DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08089","snapshot_observed_at":"2026-08-12T19:18:52.801877Z","title":"Dragnuwa: Fine-grained control in video generation by integrating text, image, and trajectory","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.801877Z"},"links":{"cited_paper":"/paper/2308.08089","citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:2b19d697a1449854e9521cf3cbd81bfcc3f5c3ccdbfaa9b90b63e08347998961","observation_id":"f056d7fa-d997-4b05-8d4d-3c68581a827c","resolution":{"observed_at":"2026-08-12T19:18:52.801877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05014","last_updated":"2025-04-06T03:43:41Z","snapshot_observed_at":"2026-08-13T00:35:31.672654Z","submitted_at":"2024-04-07T16:49:07Z","title":"MagicTime: Time-lapse Video Generation Models as Metamorphic Simulators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05014","snapshot_observed_at":"2026-08-12T19:18:52.806270Z","title":"Mag- ictime: Time-lapse video generation models as metamorphic simulators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.806270Z"},"links":{"cited_paper":"/paper/2404.05014","citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:e1851c3c5762d7a302ad3ac64d9fbe18521e3816a7a5ba2df4d71f1862ee11ee","observation_id":"4378baa2-355e-4840-8529-68514cf4a76d","resolution":{"observed_at":"2026-08-12T19:18:52.806270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.238302Z","title":"Fnevr: neu- ral volume rendering for face animation","venue":null,"work_id":"7306657f-7075-417e-9af9-285e757cb269","year":2024},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.809973Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:4674b52895271b562035c6f6ebb11e916acd6591575759549ff660e3df9ea486","observation_id":"b6753217-97b7-46ca-a050-3803525dde35","resolution":{"observed_at":"2026-08-12T19:18:53.243739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.225972Z","title":"Self-supervised learning via conditional motion propagation","venue":null,"work_id":"95899093-6ab6-419a-b587-cf659aa5e1a4","year":2019},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.814091Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:c1fe494eb98e79caf73d5cf953831f7f80848d24b28413fa9adbd7abc56d168a","observation_id":"07f4cc3f-43de-48e1-b3cd-7652c8c13ecc","resolution":{"observed_at":"2026-08-12T19:18:53.229867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.214196Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"cd214f65-7461-4217-b5eb-cfc51c4abd86","year":2023},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.818832Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:51cdf4892a8386824ca30937c7cbe9bfdbc1d053c2694cfb5362781ba27d3a84","observation_id":"f5cc611f-856e-4b99-a3bf-1d6dbc5301f8","resolution":{"observed_at":"2026-08-12T19:18:53.218160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:52.823963Z","title":"Efros, Eli Shecht- man, and Oliver Wang","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.823963Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:75fb2f41e0559096cdd54ec27b6faf43fc6a21ceaaf569caa6acad374b21b380","observation_id":"23f7da38-0bdd-4e22-96ff-00d8b9cd4735","resolution":{"observed_at":"2026-08-12T19:18:52.823963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13077","last_updated":"2023-05-22T14:48:53Z","snapshot_observed_at":"2026-08-13T11:37:13.641309Z","submitted_at":"2023-05-22T14:48:53Z","title":"ControlVideo: Training-free Controllable Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13077","snapshot_observed_at":"2026-08-12T19:18:52.828251Z","title":"Con- trolvideo: Training-free controllable text-to-video genera- tion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.828251Z"},"links":{"cited_paper":"/paper/2305.13077","citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:9253eda01ea71ff80533a9f4f85894d1e0e0c041a2d08362943189956ca30f7a","observation_id":"5898fc61-1150-438a-8b09-16c12b6e0260","resolution":{"observed_at":"2026-08-12T19:18:52.828251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.195180Z","title":"Particlesfm: Exploiting dense point trajecto- ries for localizing moving cameras in the wild","venue":null,"work_id":"1b21c6ec-a1ea-47e2-90e9-df8a1ae18206","year":null},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.833035Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:2ec9438420d5bfe7d2534de279be4f46836d1a0e11635484ca7c9ff346c284cd","observation_id":"5ac9f1ec-6e15-47e4-a4f0-02b06862fcda","resolution":{"observed_at":"2026-08-12T19:18:53.199704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.182656Z","title":"Open-sora: Democratizing efficient video production for all, 2024","venue":null,"work_id":"96a81d61-e90e-4546-99d9-462434900684","year":2024},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.836973Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:10ce434470933a00f3825dffd194713c81c8becc61430c223072405304f386f3","observation_id":"9b3d990c-53c5-4907-9d7c-c640862e3fee","resolution":{"observed_at":"2026-08-12T19:18:53.186898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.170863Z","title":"Stereo magnification","venue":null,"work_id":"8e37bb2b-495f-455d-b536-4e982090db4e","year":2018},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.840761Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:edbde929b7644d3fc90b664b342a42485b27fa29a9ad8cf6e3a1bbdc65e7a8bf","observation_id":"73769820-e91b-4d19-802c-dfb9e4f91af9","resolution":{"observed_at":"2026-08-12T19:18:53.175047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:18:53.158702Z","title":"Stereo magnification: learning view syn- thesis using multiplane images","venue":null,"work_id":"7be4dbc7-1fef-47aa-88be-04c5184782ab","year":2018},"citing_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T19:18:52.844859Z"},"links":{"citing_paper":"/paper/2411.10836"},"observation_digest":"sha256:4dd96c271341ef81471848b2ac2ad3ead50fed58588959defd6e4865b37940d8","observation_id":"d7ae3502-16f6-4451-9629-37dd7f552176","resolution":{"observed_at":"2026-08-12T19:18:53.163172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T19:12:31.866809Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":1,"verified_fuzzy":36},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 7 inbound Pith citation observations for arXiv:2411.10836."}