{"as_of":"2026-08-09T07:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5aea13d4803196fe32507af3d28dc41fd8cff9aafb68758941b187bd72bb5726","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":29,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T00:02:56.746313Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T14:08:22.301987Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2311.04145","last_updated":"2023-11-07T17:16:06Z","snapshot_observed_at":"2026-08-02T12:25:34.488259Z","submitted_at":"2023-11-07T17:16:06Z","title":"I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-17T23:51:23.877344Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2311.04145"},"observation_digest":"sha256:50a0676fc89f94b2c6e2cc8f495a9351aae30db2ce6912d137b2d1665d499a90","observation_id":"280f688d-2333-4a01-b8eb-c1b3d00dbdf1","resolution":{"observed_at":"2026-05-17T23:51:24.060207Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2402.17177","last_updated":"2024-04-17T18:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T03:30:58Z","title":"Sora: A Review on Background, Technology, Limitations, and Opportunities of Large Vision Models","version":3},"reference_index":186,"source":"pdf_text","source_observed_at":"2026-05-13T13:43:11.024069Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2402.17177"},"observation_digest":"sha256:3baa8a084c706221b6a09444b30937ae1a06066758eb95a2dc35287e7fa085c3","observation_id":"9de333e7-261f-4c71-814f-a6189ca5bbbc","resolution":{"observed_at":"2026-05-13T13:43:11.271213Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-07-06T17:54:39.685251Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"reference_index":106,"source":"arxiv_source","source_observed_at":"2026-05-13T02:06:23.410241Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2404.02101"},"observation_digest":"sha256:9bde9c5dc4e9dd38748a1705e4e8c32d60da06520937bf2075336c955eceb972","observation_id":"b3ee7103-220d-4f5e-9dc5-395356b3e0d3","resolution":{"observed_at":"2026-05-13T02:06:23.587705Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2412.14803","last_updated":"2025-05-04T04:28:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T12:48:40Z","title":"Video Prediction Policy: A Generalist Robot Policy with Predictive Visual Representations","version":2},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-05-12T18:38:11.110166Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2412.14803"},"observation_digest":"sha256:828d6fbdb948c6dea84e8f1f6edc8540484079403c88524a78762ee49715179f","observation_id":"e867b2ac-66b0-4c0e-9456-3ad609691e8c","resolution":{"observed_at":"2026-05-12T18:38:11.296554Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-08T00:02:56.746313Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08639","last_updated":"2025-02-12T18:55:36Z","snapshot_observed_at":"2026-08-09T02:55:09.026505Z","submitted_at":"2025-02-12T18:55:36Z","title":"CineMaster: A 3D-Aware and Controllable Framework for Cinematic Text-to-Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T00:02:56.746313Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2502.08639"},"observation_digest":"sha256:8f70b9575a6dcc1aa915179bb2f680bf387572be7e5fd62dcb494f4ab2222035","observation_id":"866547a4-cdd9-4e22-a574-04109815eb0b","resolution":{"observed_at":"2026-08-08T00:02:56.746313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2503.07598","last_updated":"2025-03-11T06:44:25Z","snapshot_observed_at":"2026-07-06T20:50:05.070886Z","submitted_at":"2025-03-10T17:57:04Z","title":"VACE: All-in-One Video Creation and Editing","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T00:53:53.855965Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2503.07598"},"observation_digest":"sha256:4822f4958897aa6e7318c4930869ec6bdff2b8749319d6ce8ad93322d87844c6","observation_id":"7af76aaa-1253-415a-b791-e08e6d92b745","resolution":{"observed_at":"2026-05-16T00:53:54.072091Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2504.18576","last_updated":"2026-04-24T20:54:23Z","snapshot_observed_at":"2026-07-06T21:14:57.707919Z","submitted_at":"2025-04-22T20:58:22Z","title":"DriVerse: Navigation World Model for Driving Simulation via Multimodal Trajectory Prompting and Motion Alignment","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T17:50:59.797593Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2504.18576"},"observation_digest":"sha256:0a3450f1370a3a776fed290018346c20f0649c1252701dd808d8d381180ce6e8","observation_id":"39eb1e77-0228-4df2-911b-f524723c8380","resolution":{"observed_at":"2026-05-22T17:51:54.746635Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-07T15:12:00.756816Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15973","last_updated":"2025-05-21T19:44:58Z","snapshot_observed_at":"2026-08-09T04:35:23.942170Z","submitted_at":"2025-05-21T19:44:58Z","title":"An Exploratory Study on Multi-modal Generative AI in AR Storytelling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:00.756816Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2505.15973"},"observation_digest":"sha256:5846462937d617ab935a91e2da0ee31b6d924719a92eb579815181f00520617f","observation_id":"5e47fd2c-d8dd-4aa0-a0f1-eff3369826b8","resolution":{"observed_at":"2026-08-07T15:12:00.756816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-07T14:01:03.409169Z","title":"Control- A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning.arXiv preprint arXiv:2305.13840, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20287","last_updated":"2025-05-26T17:59:03Z","snapshot_observed_at":"2026-08-08T15:17:55.449062Z","submitted_at":"2025-05-26T17:59:03Z","title":"MotionPro: A Precise Motion Controller for Image-to-Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:03.409169Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2505.20287"},"observation_digest":"sha256:e0a0f2e0c8627062d69f678afa0a645e8451dc11f697970178e3479b9d3dedc6","observation_id":"0be76838-8be6-4e89-8bb3-0b843dbf6371","resolution":{"observed_at":"2026-08-07T14:01:03.409169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-07T13:28:09.669138Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21876","last_updated":"2026-05-28T08:11:37Z","snapshot_observed_at":"2026-08-07T13:18:12.902974Z","submitted_at":"2025-05-28T01:45:26Z","title":"EPiC: Efficient Video Camera Control Learning with Precise Anchor-Video Guidance","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:09.669138Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2505.21876"},"observation_digest":"sha256:343452b9bb9f94f0ba1c73f10874478e8f0b77c8150579fb4069152729620bc8","observation_id":"6265bb98-6f1b-4913-b877-b4e52f862804","resolution":{"observed_at":"2026-08-07T13:28:09.669138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-07T12:35:24.670951Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24253","last_updated":"2025-05-30T06:19:47Z","snapshot_observed_at":"2026-08-09T06:21:13.971589Z","submitted_at":"2025-05-30T06:19:47Z","title":"Interactive Video Generation via Domain Adaptation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:24.670951Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2505.24253"},"observation_digest":"sha256:4df8a3ee551fb04fe2ac8987ca425942b056ee548092c8250c1671ee7e6da0fb","observation_id":"68360018-16aa-456e-a8ba-faf14a0f6bfd","resolution":{"observed_at":"2026-08-07T12:35:24.670951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-06T23:12:53.285283Z","title":"Control-a-video: Controllable text-to-video diffusion models with motion prior and reward feedback learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19348","last_updated":"2026-07-08T01:33:00Z","snapshot_observed_at":"2026-08-09T02:19:01.382750Z","submitted_at":"2025-06-24T06:20:15Z","title":"When Distillation Breaks Motion Control: Restoring Generative Trajectories for Fast Video Generators","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:53.285283Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2506.19348"},"observation_digest":"sha256:09322046fdafd2f144fa6eca36e0db98d2b0a88fd0a79265c634fb0f8f621f64","observation_id":"10f03514-d42c-4e74-83a9-e630447132f2","resolution":{"observed_at":"2026-08-06T23:12:53.285283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-06T15:40:17.683695Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15292","last_updated":"2025-07-24T13:26:19Z","snapshot_observed_at":"2026-08-07T05:46:43.750771Z","submitted_at":"2025-07-21T06:47:44Z","title":"EndoControlMag: Robust Endoscopic Vascular Motion Magnification with Periodic Reference Resetting and Hierarchical Tissue-aware Dual-Mask Control","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:40:17.683695Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2507.15292"},"observation_digest":"sha256:fdb15db433559018d285f55c3731ad34ebf48c9af40eec06b0c727b8c2602314","observation_id":"8a7a2673-c916-48ea-9f68-c39579bb1386","resolution":{"observed_at":"2026-08-06T15:40:17.683695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2602.13669","last_updated":"2026-04-22T07:41:44Z","snapshot_observed_at":"2026-07-06T22:45:53.926021Z","submitted_at":"2026-02-14T08:32:38Z","title":"EchoTorrent: Towards Swift, Sustained, and Streaming Multi-Modal Video Generation","version":5},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-15T22:20:16.320171Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2602.13669"},"observation_digest":"sha256:26fa0fafcbc8d71d58a2e8f3367c23a421a79c004addda018014ee7eeae7691e","observation_id":"5555296c-c5d0-467e-a650-d84d77d99eb3","resolution":{"observed_at":"2026-05-15T22:20:22.235144Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-14T21:09:36.040879Z","title":"arXiv preprint arXiv:2305.13840 (2023) 4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.14526","last_updated":"2026-06-28T22:57:12Z","snapshot_observed_at":"2026-08-02T01:05:20.949344Z","submitted_at":"2026-03-15T18:07:29Z","title":"LatSearch: Latent Reward-Guided Search for Faster Inference-Time Scaling in Video Diffusion","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T21:09:36.040879Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2603.14526"},"observation_digest":"sha256:cb0196c6a724a06e00ff8d7eae5717fc8992e13751699bc571d8a039068c490c","observation_id":"6a639890-01dd-4c01-a990-a90f8e36c5d4","resolution":{"observed_at":"2026-07-14T21:09:36.040879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2603.29092","last_updated":"2026-05-19T01:55:09Z","snapshot_observed_at":"2026-08-02T07:26:05.311068Z","submitted_at":"2026-03-31T00:15:36Z","title":"TrajectoryMover: Generative Movement of Object Trajectories in Videos","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-14T00:19:36.166355Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2603.29092"},"observation_digest":"sha256:0f0d0a3db1fce4c9a45aeb796739b69771dcbf29047c96358d1796ce8af3d10e","observation_id":"963b8f16-2487-4a69-9323-5706928ec06b","resolution":{"observed_at":"2026-05-14T00:23:29.619402Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2603.29092","last_updated":"2026-05-19T01:55:09Z","snapshot_observed_at":"2026-08-02T07:26:05.311068Z","submitted_at":"2026-03-31T00:15:36Z","title":"TrajectoryMover: Generative Movement of Object Trajectories in Videos","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T11:05:30.004725Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2603.29092"},"observation_digest":"sha256:e793edbe70fd432f0ea5a66356710d896a013affca3092c1e7c427c5cba5c1f2","observation_id":"dc539390-1a74-46f5-8cfd-14337854069a","resolution":{"observed_at":"2026-05-21T11:10:02.273692Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2604.02467","last_updated":"2026-04-27T18:17:15Z","snapshot_observed_at":"2026-08-02T13:43:39.563153Z","submitted_at":"2026-04-02T18:58:56Z","title":"VERTIGO: Visual Preference Optimization for Cinematic Camera Trajectory Generation","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T21:14:42.021240Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2604.02467"},"observation_digest":"sha256:66908dcc7b8d0fdc15b1ab5077a6e38d1e7a617240d4dbdf60d182091aeab9bb","observation_id":"0b8f6de3-841f-41a7-90c5-78395243a1d5","resolution":{"observed_at":"2026-05-13T21:18:17.214760Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2604.19679","last_updated":"2026-06-29T16:38:23Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T16:57:23Z","title":"MMControl: Unified Multi-Modal Control for Joint Audio-Video Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T02:55:09.008954Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2604.19679"},"observation_digest":"sha256:8c1d7cc58fb38b5a19eb1fca188cf9f91a866d2d5b5a230527705150bb5383be","observation_id":"5a377280-6e9d-4670-998b-c61a273fe260","resolution":{"observed_at":"2026-05-11T12:46:27.987657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2605.10543","last_updated":"2026-05-25T17:58:28Z","snapshot_observed_at":"2026-08-02T23:34:29.256048Z","submitted_at":"2026-05-11T13:23:14Z","title":"TIE: Time Interval Encoding for Video Generation over Events","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T04:26:23.558427Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2605.10543"},"observation_digest":"sha256:534ff1674274ab0cd35da4e965570eed6e49f20fb6edd9d2b5b8590876387088","observation_id":"5af1e70f-c28f-4b46-90d5-accaab4d1253","resolution":{"observed_at":"2026-05-12T06:16:28.071650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2605.10543","last_updated":"2026-05-25T17:58:28Z","snapshot_observed_at":"2026-08-02T23:34:29.256048Z","submitted_at":"2026-05-11T13:23:14Z","title":"TIE: Time Interval Encoding for Video Generation over Events","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T22:47:55.768380Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2605.10543"},"observation_digest":"sha256:06d2cd6146de9a68992040be700d7d020e9f4d9f0d9a44351e82aaa7df451fef","observation_id":"b3a478e2-0c81-4b5d-b64f-9e7129a9deab","resolution":{"observed_at":"2026-07-01T13:45:45.966257Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2605.15116","last_updated":"2026-05-14T17:29:35Z","snapshot_observed_at":"2026-07-06T23:26:28.006734Z","submitted_at":"2026-05-14T17:29:35Z","title":"DriveCtrl: Conditioned Sim-to-Real Driving Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T21:06:06.548538Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2605.15116"},"observation_digest":"sha256:0849fd7d1d58a8ca5b16a9218b3562be067c1a65fe66b066475235c6fab4c05a","observation_id":"da9572a3-4278-46c2-a49a-467768c04d03","resolution":{"observed_at":"2026-06-30T21:15:04.792745Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2605.15256","last_updated":"2026-05-14T17:52:03Z","snapshot_observed_at":"2026-08-06T12:51:31.154504Z","submitted_at":"2026-05-14T17:52:03Z","title":"ReactiveGWM: Steering NPC in Reactive Game World Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T16:32:57.227291Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2605.15256"},"observation_digest":"sha256:332da1826e676d5cd8f7e3063e3b49b42ec15f53f1518c97a6e0ee7898402634","observation_id":"184c5922-45a2-49bf-a756-be55cbf6ce69","resolution":{"observed_at":"2026-05-19T16:33:08.255618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2605.23602","last_updated":"2026-05-22T13:11:23Z","snapshot_observed_at":"2026-08-02T15:51:31.409896Z","submitted_at":"2026-05-22T13:11:23Z","title":"GlowGS: Generative Semantic Feature Learning for 3D Gaussian Splatting in Nighttime Glow Scenes","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-25T04:59:57.934468Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2605.23602"},"observation_digest":"sha256:f8237f2ea30c1de6cfe38a4f0ee3771abb704fbd119bf5465a9e5c8286c814a9","observation_id":"539acb2b-9844-462f-b9e9-dbdf4976ab41","resolution":{"observed_at":"2026-05-25T05:00:21.448039Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2605.29509","last_updated":"2026-05-28T07:31:22Z","snapshot_observed_at":"2026-07-06T23:38:56.014434Z","submitted_at":"2026-05-28T07:31:22Z","title":"KGEdit: Ambiguity-Aware Knowledge Graphs for Training-Free Precise Video Generation and Editing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T08:46:56.390567Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2605.29509"},"observation_digest":"sha256:da49a5baf51a1a05643a8c8644d366e0b4862502a8dca9ed89d8145d80a53219","observation_id":"3b51de1b-3ff5-4d0a-80b9-b1a8d76c729b","resolution":{"observed_at":"2026-06-29T08:53:16.145069Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2606.02586","last_updated":"2026-05-11T16:42:10Z","snapshot_observed_at":"2026-08-05T10:31:48.098328Z","submitted_at":"2026-05-11T16:42:10Z","title":"Fewer, Better Frames: A Compute-Normalized Proof of Concept for Coherence-First World-Model Rendering with Model-Guided FSR4 Frame Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T22:23:32.586583Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2606.02586"},"observation_digest":"sha256:85da31cd14c660241a2c4b38b3cdb160818ad7b5555af18e6b80453c72aa6aa7","observation_id":"77c00844-e55f-42b1-af7c-2754800aaaac","resolution":{"observed_at":"2026-06-30T22:25:06.905310Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2606.13432","last_updated":"2026-06-11T14:58:28Z","snapshot_observed_at":"2026-08-07T08:13:15.764180Z","submitted_at":"2026-06-11T14:58:28Z","title":"OmniDirector: General Multi-Shot Camera Cloning without Cross-Paired Data","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-06-27T07:11:06.592722Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2606.13432"},"observation_digest":"sha256:ed1c24b56577cb057859d955ea3a477ce22990080ec4e79b71eaec84542ad294","observation_id":"1ed944a4-e1c5-4b70-aec3-21328f7ec536","resolution":{"observed_at":"2026-07-03T14:08:22.303472Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2606.29020","last_updated":"2026-06-27T17:38:21Z","snapshot_observed_at":"2026-07-07T00:03:02.476882Z","submitted_at":"2026-06-27T17:38:21Z","title":"Semantic-Aware, Physics-Informed, Geometry-Grounded Weather Video Synthesis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T09:19:50.748415Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2606.29020"},"observation_digest":"sha256:fe5b6a5a64185a118259703a576ca67086dacb9e9bd2c98179560713acfcdab1","observation_id":"81c939f4-78cf-4879-91f1-a9353615b0ea","resolution":{"observed_at":"2026-06-30T09:24:32.498002Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-11T09:28:19.511968Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05056","last_updated":"2026-07-06T13:29:28Z","snapshot_observed_at":"2026-08-06T03:32:27.768727Z","submitted_at":"2026-07-06T13:29:28Z","title":"Consistent and Editable: A Balanced Framework for Text-Guided Video Editing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T09:28:19.511968Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2607.05056"},"observation_digest":"sha256:b343717e8b69ea9988f75fc61ee5fc7ae194affe95300ad6cd39ca6541b7bc59","observation_id":"292ce81a-d339-4c47-b250-a5930df2e200","resolution":{"observed_at":"2026-07-11T09:28:19.511968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2305.13840/citation-record","integrity":"/paper/2305.13840/integrity","json":"/paper/2305.13840/citation-record.json","paper":"/paper/2305.13840"},"outbound":[],"paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 29 inbound Pith citation observations for arXiv:2305.13840."}