{"as_of":"2026-08-07T18:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2db7a6404228897f282045c2e41991def653d8aad6bea5a6a5afe5f0fd47bf14","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":45,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:28:15.326322Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T13:14:53.143564Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-08-07T13:28:15.326322Z","title":"Zheng, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21876","last_updated":"2026-05-28T08:11:37Z","snapshot_observed_at":"2026-08-07T13:18:12.902974Z","submitted_at":"2025-05-28T01:45:26Z","title":"EPiC: Efficient Video Camera Control Learning with Precise Anchor-Video Guidance","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:15.326322Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2505.21876"},"observation_digest":"sha256:724f5a345c9410dc3a844d619bdf1c3b4827a59db1ef768b64b8b3806e436eed","observation_id":"d7b39193-67c2-42d0-b706-cb5563fdfc97","resolution":{"observed_at":"2026-08-07T13:28:15.326322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-08-07T12:59:49.584736Z","title":"Cami2v: Camera-controlled image-to-video dif- fusion model.arXiv preprint arXiv:2410.15957, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22944","last_updated":"2025-06-10T06:15:58Z","snapshot_observed_at":"2026-08-07T12:54:34.367036Z","submitted_at":"2025-05-28T23:49:18Z","title":"ATI: Any Trajectory Instruction for Controllable Video Generation","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:49.584736Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2505.22944"},"observation_digest":"sha256:318babcd77a9f09aa0d35e1c692b60a7071c09f458c7b658b9e610326b957c3a","observation_id":"51d4e02c-a178-4f3d-acee-d4ab1cef126e","resolution":{"observed_at":"2026-08-07T12:59:49.584736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-08-07T10:51:43.122786Z","title":"Cami2v: Camera- controlled image-to-video diffusion model.arXiv preprint arXiv:2410.15957, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04216","last_updated":"2025-06-04T17:57:43Z","snapshot_observed_at":"2026-08-07T10:43:11.214330Z","submitted_at":"2025-06-04T17:57:43Z","title":"UNIC: Unified In-Context Video Editing","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T10:51:43.122786Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2506.04216"},"observation_digest":"sha256:7b53a992c811ced25350ea449da48eef9bfac77e119e353e18a325b45020a934","observation_id":"91663df3-bb8f-4558-af8c-c3d3a2f925ad","resolution":{"observed_at":"2026-08-07T10:51:43.122786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-08-07T10:43:27.501326Z","title":"Cami2v: Camera- controlled image-to-video diffusion model.arXiv preprint arXiv:2410.15957, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04590","last_updated":"2025-06-05T03:11:48Z","snapshot_observed_at":"2026-08-07T10:36:04.209889Z","submitted_at":"2025-06-05T03:11:48Z","title":"Follow-Your-Creation: Empowering 4D Creation through Video Inpainting","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:27.501326Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2506.04590"},"observation_digest":"sha256:6751327769bed0169f25b0c20073a3ee84f5be0101303f7ceaaffb6cd8414e21","observation_id":"e017a029-82e1-44d5-b7da-3bda231a154c","resolution":{"observed_at":"2026-08-07T10:43:27.501326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-08-07T10:19:08.140245Z","title":"\" \" 6A VAE model for encoding camera i n f o r m a t i o n and video features . 7","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05554","last_updated":"2025-06-05T20:02:05Z","snapshot_observed_at":"2026-08-07T10:11:42.367873Z","submitted_at":"2025-06-05T20:02:05Z","title":"EX-4D: EXtreme Viewpoint 4D Video Synthesis via Depth Watertight Mesh","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:08.140245Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2506.05554"},"observation_digest":"sha256:5f032187fdb643dcb89cc7bb6feaf90037ccb6610dc73bf089b3aafb3a5ea7d6","observation_id":"2ef616ac-daec-440d-bbd9-c5441e436ef8","resolution":{"observed_at":"2026-08-07T10:19:08.140245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-08-06T19:25:28.767942Z","title":"Cami2v: Camera-controlled image-to-video dif- fusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":119,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.767942Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:d316ec07cf887cbaf6f6a4b9e9411f59df147c5b0abfc227770aa1df03a0ab52","observation_id":"58248d9e-db38-482a-b09f-30e80edbb5ee","resolution":{"observed_at":"2026-08-06T19:25:28.767942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-08-06T16:39:40.082821Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12956","last_updated":"2025-07-17T09:50:43Z","snapshot_observed_at":"2026-08-06T21:23:59.012209Z","submitted_at":"2025-07-17T09:50:43Z","title":"FantasyPortrait: Enhancing Multi-Character Portrait Animation with Expression-Augmented Diffusion Transformers","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:40.082821Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2507.12956"},"observation_digest":"sha256:fd93b8967fafad654e87035a2d4fe92469fbd899f3aacddca8c485f769b4dcb6","observation_id":"2ccc28f8-3bb7-4156-90ec-1112c62db830","resolution":{"observed_at":"2026-08-06T16:39:40.082821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-08-05T11:42:08.547485Z","title":"Cami2v: Camera-controlled image-to-video dif- fusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02466","last_updated":"2025-09-02T16:20:20Z","snapshot_observed_at":"2026-08-07T06:55:22.300462Z","submitted_at":"2025-09-02T16:20:20Z","title":"TeRA: Rethinking Text-guided Realistic 3D Avatar Generation","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-05T11:42:08.547485Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2509.02466"},"observation_digest":"sha256:76107ac3136068f5177fbca82f8e151e53aec7a4cbb390f40aa792515859ddc6","observation_id":"78806793-234f-4eee-a329-93b53be9e0cc","resolution":{"observed_at":"2026-08-05T11:42:08.547485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-08-04T11:42:19.755114Z","title":"Tora: Trajectory-oriented diffusion transformer for video generation","venue":null,"work_id":null,"year":2063},"citing_paper":{"arxiv_id":"2510.03550","last_updated":"2026-05-28T15:10:18Z","snapshot_observed_at":"2026-08-05T03:04:06.220846Z","submitted_at":"2025-10-03T22:38:35Z","title":"Streaming Drag-Oriented Interactive Video Manipulation: Drag Anything, Anytime!","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T11:42:19.755114Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2510.03550"},"observation_digest":"sha256:75f28a273e6c648b6d8b94f1311c503561ecd70b1960a730fb1b626eb65be8f5","observation_id":"53f494ee-ceef-48a4-99f9-e6379d85f132","resolution":{"observed_at":"2026-08-04T11:42:19.755114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-08-04T08:20:10.351014Z","title":"Cami2v: Camera-controlled image-to-video diffusion model.arXiv preprint arXiv:2410.15957,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.21615","last_updated":"2026-06-17T16:22:08Z","snapshot_observed_at":"2026-08-06T09:36:16.630593Z","submitted_at":"2025-10-24T16:21:37Z","title":"Epipolar Geometry Improves Video Generation Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T08:20:10.351014Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2510.21615"},"observation_digest":"sha256:3a49dbbb1d6953f479df1481a0a96e3f6172ccfc9ee052b95e87b690b860a6e6","observation_id":"0aea6d17-527c-4827-ad83-cc30a7ced55a","resolution":{"observed_at":"2026-08-04T08:20:10.351014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-08-03T21:01:10.508086Z","title":"Cami2v: Camera-controlled image-to-video dif- fusion model.arXiv preprint arXiv:2410.15957, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:10.508086Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:5f45628481ee2a815d09f29cbb5dba7d6873c92f2c8e2d6a4211a2574a7b4348","observation_id":"5f398621-9666-4553-a647-192282fa0374","resolution":{"observed_at":"2026-08-03T21:01:10.508086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2604.07209","last_updated":"2026-04-13T13:03:18Z","snapshot_observed_at":"2026-07-06T22:55:28.855291Z","submitted_at":"2026-04-08T15:31:22Z","title":"INSPATIO-WORLD: A Real-Time 4D World Simulator via Spatiotemporal Autoregressive Modeling","version":2},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-05-10T19:08:56.588282Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2604.07209"},"observation_digest":"sha256:fab03346bfd83a54a70218dad48df9d90e7dafbe7e17b00dcb70160eea3c417e","observation_id":"9e6f5839-8956-49da-bc29-1650e2077dea","resolution":{"observed_at":"2026-05-10T23:25:53.327357Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2604.08500","last_updated":"2026-04-09T17:44:18Z","snapshot_observed_at":"2026-07-06T22:57:35.435713Z","submitted_at":"2026-04-09T17:44:18Z","title":"Novel View Synthesis as Video Completion","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-10T18:26:39.418764Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2604.08500"},"observation_digest":"sha256:2aee874ed4835c943b17c60e4f3ff3a7122fea73fda3759a4d0c961d8b4737e2","observation_id":"5bb6099e-1cc4-48bc-b210-772b0e39e8eb","resolution":{"observed_at":"2026-05-11T00:35:50.614459Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2604.17565","last_updated":"2026-06-26T02:04:58Z","snapshot_observed_at":"2026-07-06T23:04:37.370465Z","submitted_at":"2026-04-19T18:11:08Z","title":"UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-10T06:03:06.920592Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2604.17565"},"observation_digest":"sha256:a5ad16a6332486d11d27124c162271ac99d7a8278f2ebdab4cdb6aa405d8911d","observation_id":"4e5d0800-df2d-43bc-802c-097d3a21930d","resolution":{"observed_at":"2026-05-10T06:06:18.943756Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2604.17565","last_updated":"2026-06-26T02:04:58Z","snapshot_observed_at":"2026-07-06T23:04:37.370465Z","submitted_at":"2026-04-19T18:11:08Z","title":"UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-12T02:52:58.232585Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2604.17565"},"observation_digest":"sha256:ca8bdddc9075872eb2caa8f2e5dd9baa68e80db802f34eae00496ced1d1825d4","observation_id":"e968fffd-1571-4fac-ac54-6513b76876ab","resolution":{"observed_at":"2026-05-12T07:26:29.807984Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2604.17565","last_updated":"2026-06-26T02:04:58Z","snapshot_observed_at":"2026-07-06T23:04:37.370465Z","submitted_at":"2026-04-19T18:11:08Z","title":"UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models","version":4},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-07-05T16:47:32.853010Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2604.17565"},"observation_digest":"sha256:f88598e7ffe22f998bbc89ffe4bc503749e58bfef09779bf01ca3cb920d9843d","observation_id":"74d6e2f6-742b-473e-9e9b-b0b2853c7802","resolution":{"observed_at":"2026-07-05T16:51:14.174653Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2604.28169","last_updated":"2026-04-30T17:53:03Z","snapshot_observed_at":"2026-08-03T10:24:52.149592Z","submitted_at":"2026-04-30T17:53:03Z","title":"PhyCo: Learning Controllable Physical Priors for Generative Motion","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-07T05:36:50.126298Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2604.28169"},"observation_digest":"sha256:bd143ed77812d47ca53185b77b5f03fcfb2c9fbf44e3c9e5ef9873daff613da5","observation_id":"dda8db52-9b04-449f-8953-8c1085d3c083","resolution":{"observed_at":"2026-05-12T10:36:29.100358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2605.05187","last_updated":"2026-05-06T17:52:39Z","snapshot_observed_at":"2026-08-05T11:06:48.787619Z","submitted_at":"2026-05-06T17:52:39Z","title":"LoViF 2026 The First Challenge on Holistic Quality Assessment for 4D World Model (PhyScore)","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-08T16:20:40.024442Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2605.05187"},"observation_digest":"sha256:d70dfcb4ea88396a5d08952faa824441c710cb1a47a0c191249ca8e0058aa08e","observation_id":"4cc1d618-7b7c-45f4-99a2-6e153051efa7","resolution":{"observed_at":"2026-05-11T18:16:11.782145Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2605.13838","last_updated":"2026-06-27T12:19:23Z","snapshot_observed_at":"2026-08-01T20:39:26.680238Z","submitted_at":"2026-05-13T17:58:13Z","title":"R-DMesh: Video-Guided 3D Animation via Rectified Dynamic Mesh Flow","version":1},"reference_index":155,"source":"arxiv_source","source_observed_at":"2026-05-14T19:07:53.671769Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2605.13838"},"observation_digest":"sha256:20ca8c5c50702c65fbe7b6a05556114bddb9eaa936f89b7a3a5aeaa971b07c2a","observation_id":"a61ad0ea-ecb8-4275-8ccf-d41c385a7c86","resolution":{"observed_at":"2026-05-14T19:09:23.601934Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2605.13838","last_updated":"2026-06-27T12:19:23Z","snapshot_observed_at":"2026-08-01T20:39:26.680238Z","submitted_at":"2026-05-13T17:58:13Z","title":"R-DMesh: Video-Guided 3D Animation via Rectified Dynamic Mesh Flow","version":2},"reference_index":155,"source":"arxiv_source","source_observed_at":"2026-05-15T06:08:52.321351Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2605.13838"},"observation_digest":"sha256:e8cc09985792dcafaf5f47135b00801bd4dfdbc5d89bc35c3f4149024da50efb","observation_id":"f1d029eb-0c70-4523-8c78-208db489d4ac","resolution":{"observed_at":"2026-05-15T06:09:49.671558Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2605.16937","last_updated":"2026-05-16T11:14:18Z","snapshot_observed_at":"2026-08-01T18:52:35.499750Z","submitted_at":"2026-05-16T11:14:18Z","title":"DEVIS-GRPO: Unleashing GRPO on Dynamic Extreme View Synthesis","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-19T20:53:42.240453Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2605.16937"},"observation_digest":"sha256:c1e0f03e20596cbeb3c3d0fd11dd3301ad5946df929ffc08e5dab62319d99eb4","observation_id":"5cba3c1c-4c19-4150-99bc-2d4b70cddaf7","resolution":{"observed_at":"2026-05-19T20:57:46.998019Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2605.17248","last_updated":"2026-05-17T04:10:55Z","snapshot_observed_at":"2026-08-02T22:41:54.302633Z","submitted_at":"2026-05-17T04:10:55Z","title":"Image-to-Video Diffusion: From Foundations to Open Frontiers","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-20T15:06:02.084336Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2605.17248"},"observation_digest":"sha256:cb8019d846df850aef3315bf341644e75d2cf144dfbfdc8ef7285cb2b1574d7a","observation_id":"ace46b62-6745-40c0-abfa-13ec39c0e658","resolution":{"observed_at":"2026-05-20T15:08:24.844018Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2605.18365","last_updated":"2026-05-18T13:17:08Z","snapshot_observed_at":"2026-08-02T07:31:08.555715Z","submitted_at":"2026-05-18T13:17:08Z","title":"GeoFlow: Enforcing Implicit Geometric Consistency in Video Generation","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-20T11:06:09.367559Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2605.18365"},"observation_digest":"sha256:3d1dc2bcc8ab5b94bf0a5a80b6eb9c2afe8d342e8f722384bad39f84327e8f75","observation_id":"edc30d64-aaf6-4e32-b173-e6859cf89d77","resolution":{"observed_at":"2026-05-20T11:08:13.570285Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2605.26316","last_updated":"2026-05-25T20:13:16Z","snapshot_observed_at":"2026-08-01T03:37:55.526828Z","submitted_at":"2026-05-25T20:13:16Z","title":"E$^3$C: Video Generation with 3D Environmental Memory and Ego-Exo Human Pose Control","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-29T22:24:38.389294Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2605.26316"},"observation_digest":"sha256:11f0e5d7e66392d44a655e07ebe696762f925d4855fc864f7f2b4010cbb707d7","observation_id":"123d047f-2afb-4eda-8cf4-6e594d79d9cc","resolution":{"observed_at":"2026-06-29T22:34:02.419686Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2606.01590","last_updated":"2026-06-01T02:37:56Z","snapshot_observed_at":"2026-08-02T14:53:31.726245Z","submitted_at":"2026-06-01T02:37:56Z","title":"Effective Multi-sensor Conditioning for Street-view Novel-view Synthesis","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-28T15:33:51.064212Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2606.01590"},"observation_digest":"sha256:63bd5440bf249670974f8e51ed96ac253e85f0435425f55251840cf24632ab29","observation_id":"0d545737-091d-40ee-bb32-271b89e7f427","resolution":{"observed_at":"2026-07-01T22:16:16.453749Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2606.07508","last_updated":"2026-06-05T17:57:32Z","snapshot_observed_at":"2026-08-03T10:42:24.485829Z","submitted_at":"2026-06-05T17:57:32Z","title":"Streaming Video Generation with Streaming Force Control","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-06-27T22:14:32.465663Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2606.07508"},"observation_digest":"sha256:4a2a0577b5b71fe1037d353e2ca680aff5a2f503cc2f6723d22a80db993bb06a","observation_id":"458a23da-567c-4a1b-a825-7297cd1c6b43","resolution":{"observed_at":"2026-07-02T17:07:12.434164Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2606.13432","last_updated":"2026-06-11T14:58:28Z","snapshot_observed_at":"2026-08-07T08:13:15.764180Z","submitted_at":"2026-06-11T14:58:28Z","title":"OmniDirector: General Multi-Shot Camera Cloning without Cross-Paired Data","version":1},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-06-27T07:11:06.592722Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2606.13432"},"observation_digest":"sha256:8af7c95fcfb73c7e2a7e926e3787567ff2ee59f1b7ae9ee6351980ababdc6bc4","observation_id":"7459300a-70af-43c0-8452-ebf154936b46","resolution":{"observed_at":"2026-07-03T14:08:22.280583Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2606.13768","last_updated":"2026-06-16T17:59:39Z","snapshot_observed_at":"2026-08-06T01:41:21.935867Z","submitted_at":"2026-06-11T17:59:10Z","title":"CineOrchestra: Unified Entity-Centric Conditioning for Cinematic Video Generation","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-27T06:51:31.625416Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2606.13768"},"observation_digest":"sha256:81c2072e3b1bd46786819deadefbed240cd708b26cfc90c5f8dfbc0d605f2153","observation_id":"27df140f-a41d-413f-a1c9-0491c03558ef","resolution":{"observed_at":"2026-07-03T14:58:32.701652Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2606.20774","last_updated":"2026-06-18T16:07:05Z","snapshot_observed_at":"2026-08-02T15:04:03.513314Z","submitted_at":"2026-06-18T16:07:05Z","title":"TriMotion: Modality-Agnostic Camera Control for Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T18:11:49.696524Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2606.20774"},"observation_digest":"sha256:5c27d85aaeecfe88be2ec2f0f0a28d03fa4e2e7b0014451f544368268068c349","observation_id":"be8d783a-33cf-44af-a156-c2b4c26d7923","resolution":{"observed_at":"2026-07-04T03:19:31.255011Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2606.23105","last_updated":"2026-06-22T09:46:36Z","snapshot_observed_at":"2026-07-06T23:57:53.101659Z","submitted_at":"2026-06-22T09:46:36Z","title":"Compression and Retrieval: Implicit Memory Retrieval for Video World Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T08:46:28.619102Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2606.23105"},"observation_digest":"sha256:1ff53032012bac7badc27fb801766e3605d15a9fbb85960b8839ad7d05a71482","observation_id":"e1f2ee9b-e668-4027-a464-9dfac84fc5c6","resolution":{"observed_at":"2026-07-04T10:29:45.423147Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2606.24107","last_updated":"2026-07-03T09:17:12Z","snapshot_observed_at":"2026-08-01T13:42:02.404759Z","submitted_at":"2026-06-23T03:50:28Z","title":"DramaDirector: Geometry-Guided Short Drama Generation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-26T01:57:15.550335Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2606.24107"},"observation_digest":"sha256:74211cb45b2716361c5c884ff255df2f31f0c074c4811741c34d3cef6384a452","observation_id":"f12635bd-a683-49f0-93a3-0f86842463a7","resolution":{"observed_at":"2026-07-04T14:59:55.955984Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-05T10:16:29.451498Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-29T02:03:45.564122Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:999d163553a32926e7107106dfd8032f8ca03bffb8c9fe3262b37376e2d24188","observation_id":"a7992705-ea10-41a1-8584-5cd010cdc18b","resolution":{"observed_at":"2026-07-01T18:25:57.754258Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-05T10:16:29.451498Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-07-01T06:25:58.872140Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:9dcd204d3d64bd4121ada35deadb76537ef57d8cffdd2f178997967a7dddf50e","observation_id":"c07b41f5-8926-4ccb-8b16-98b60d67bba5","resolution":{"observed_at":"2026-07-01T09:35:40.531941Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-05T10:16:29.451498Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-07-02T20:52:28.444524Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:18769ea89752da65a6f98e810392c6859e0529ad1096102023bb600cdc2cdf8d","observation_id":"e3f8e1dc-0610-4d08-87b7-df89d35bbd83","resolution":{"observed_at":"2026-07-02T20:57:22.744796Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-05T10:16:29.451498Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":4},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-07-03T22:44:16.272541Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:052b5b7b60446a6905581a507ada19e959e2e0434da4fa9053a40ab26a417edf","observation_id":"63747f1c-e3f9-4e59-8caa-182127842b23","resolution":{"observed_at":"2026-07-03T22:49:00.953132Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-14T17:14:19.770867Z","title":"arXiv preprint arXiv:2410.15957 (2024) 3","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-05T10:16:29.451498Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":5},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-07-14T17:14:19.770867Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:72a6d590c621d434f6076e1414dd65f05ea78db014c758bfb02ba4c4abc87d45","observation_id":"f4be19af-3064-4930-b302-f59f3a0cb117","resolution":{"observed_at":"2026-07-14T17:14:19.770867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-08-02T10:00:17.519668Z","title":"arXiv preprint arXiv:2410.15957 (2024) 3","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-05T10:16:29.451498Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":6},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-02T10:00:17.519668Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:704102384b81b31f0a8bfc1811b081c26f04cb7d72db57e740bb78de40979c90","observation_id":"110dc149-2cec-4763-87da-0f9fc10b618e","resolution":{"observed_at":"2026-08-02T10:00:17.519668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2606.27964","last_updated":"2026-06-26T11:08:09Z","snapshot_observed_at":"2026-07-07T00:02:09.217954Z","submitted_at":"2026-06-26T11:08:09Z","title":"Directing the World: Fast Autoregressive Video Generation with Compositional Human-Camera Control","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-29T05:03:56.624536Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2606.27964"},"observation_digest":"sha256:7d8201bfdf1554fa202dbe58a2329e9b02fe250e0418f3e131d3a1dc9b41ec7b","observation_id":"56a85279-1c1a-4b79-bcdd-0840b9ed02ee","resolution":{"observed_at":"2026-06-29T18:33:51.333790Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-12T08:04:48.963890Z","title":"Cami2v: Camera-controlled image-to-video diffusion model.arXiv preprint arXiv:2410.15957, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02642","last_updated":"2026-07-02T17:02:43Z","snapshot_observed_at":"2026-08-03T12:39:47.539491Z","submitted_at":"2026-07-02T17:02:43Z","title":"GigaWorld-1: A Roadmap to Build World Models for Robot Policy Evaluation","version":1},"reference_index":156,"source":"pdf_text","source_observed_at":"2026-07-12T08:04:48.963890Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2607.02642"},"observation_digest":"sha256:bac3248e84373dec500e4e2cf15bf57f063eb590c3dae6b62ee880b526decda9","observation_id":"7ccd5d2d-6c8a-4074-ba60-faa9256f1ef6","resolution":{"observed_at":"2026-07-12T08:04:48.963890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Cami2v: Camera-controlled image-to-video diffusion model.arXiv preprint arXiv:2410.15957, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-03T09:38:13.465849Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:3cf040bfde7fe609635cde81a18dd73bd4fcf4811584b1951431117a338b78f4","observation_id":"4fd69936-7f3e-41ea-930f-e85b26ad3a84","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2607.06216","last_updated":"2026-08-03T15:49:45Z","snapshot_observed_at":"2026-08-06T23:37:49.737678Z","submitted_at":"2026-07-07T12:41:19Z","title":"MoWorld: A Flash World Model","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-08T13:10:31.940263Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2607.06216"},"observation_digest":"sha256:3de38ced516c8d9aab33ad76b5d13ed9c2123a2d12ee821758bac99de53986f0","observation_id":"d3f02d40-8357-4b6b-8971-014d0fe1594e","resolution":{"observed_at":"2026-07-08T13:14:53.145139Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-08-04T04:32:04.132232Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06216","last_updated":"2026-08-03T15:49:45Z","snapshot_observed_at":"2026-08-06T23:37:49.737678Z","submitted_at":"2026-07-07T12:41:19Z","title":"MoWorld: A Flash World Model","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T04:32:04.132232Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2607.06216"},"observation_digest":"sha256:d2fde9a47b979672c4d711da6b3d909e0e6e136a7b2c105439f346dc88736366","observation_id":"026ecc52-6ccb-4657-89ca-ff11404e9e73","resolution":{"observed_at":"2026-08-04T04:32:04.132232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2410.15957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-08T13:14:53.143564Z","title":"Cami2v: Camera-controlled image-to-video diffusion model","venue":"cs.CV","work_id":"dfc5b040-8e44-47be-8714-65cc5b5f8400","year":2024},"citing_paper":{"arxiv_id":"2607.06291","last_updated":"2026-07-07T13:59:57Z","snapshot_observed_at":"2026-08-07T13:27:54.852993Z","submitted_at":"2026-07-07T13:59:57Z","title":"AlayaWorld: Long-Horizon and Playable Video World Generation","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-07-08T10:53:28.412288Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2607.06291"},"observation_digest":"sha256:4291d2cdceaadbd64cc458f84303d929b81e8d9f82b3f7c224a982d8fd069672","observation_id":"05a0ef60-6d81-4a8c-8b5c-6190ec6d4cce","resolution":{"observed_at":"2026-07-08T10:54:49.271586Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-08-02T02:52:22.140217Z","title":"Zheng, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14076","last_updated":"2026-07-15T17:48:48Z","snapshot_observed_at":"2026-08-02T02:52:11.633120Z","submitted_at":"2026-07-15T17:48:48Z","title":"From Pixels to States: Rethinking Interactive World Models as Game Engines","version":1},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-08-02T02:52:22.140217Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2607.14076"},"observation_digest":"sha256:b2a007e4d8f0696038023501f0998a13089de910f10faae2cb952c3fe97d633e","observation_id":"43337b0a-9b4d-447a-b628-ec576c7d8b6b","resolution":{"observed_at":"2026-08-02T02:52:22.140217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-31T13:00:40.639492Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28261","last_updated":"2026-08-02T14:44:50Z","snapshot_observed_at":"2026-08-06T23:24:52.946137Z","submitted_at":"2026-07-30T14:18:43Z","title":"TARS: Timestep-Aware Data Scaling for 3D-Free Video Re-Shooting","version":1},"reference_index":121,"source":"arxiv_source","source_observed_at":"2026-07-31T13:00:40.639492Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2607.28261"},"observation_digest":"sha256:3d1ebcad0935456ede03e424818ecd2372e001ae962c51ce806ff9ade6078b1d","observation_id":"1a89062c-f74d-4a9c-936f-18bdfb0ef7df","resolution":{"observed_at":"2026-07-31T13:00:40.639492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.15957/citation-record","integrity":"/paper/2410.15957/integrity","json":"/paper/2410.15957/citation-record.json","paper":"/paper/2410.15957"},"outbound":[],"paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 45 inbound Pith citation observations for arXiv:2410.15957."}