{"as_of":"2026-08-09T06:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c6bcebcfc5c12dc92ac44320e840e52d079b659019c0e67830a2f36f49910c84","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":48,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T12:16:44.707094Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T10:29:44.541818Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-08T04:36:41.409539Z","title":"Anyv2v: A tuning-free framework for any video-to- video editing tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08590","last_updated":"2025-03-12T08:38:20Z","snapshot_observed_at":"2026-08-09T04:47:31.741642Z","submitted_at":"2025-02-12T17:24:19Z","title":"Light-A-Video: Training-free Video Relighting via Progressive Light Fusion","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T04:36:41.409539Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2502.08590"},"observation_digest":"sha256:3826155a66a91d4cddb3635f493e41488ae97a09384118e614e6d3891de1574b","observation_id":"4aa79f6b-927b-41c4-94fd-677490ae8f71","resolution":{"observed_at":"2026-08-08T04:36:41.409539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-07T12:57:01.251723Z","title":"Anyv2v: A plug-and-play framework for any video-to-video editing tasks.arXiv preprint arXiv:2403.14468, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-07T12:50:25.240639Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.251723Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:7be7f1cbe187160d4706d6b73c4cedcd8f6c59db20e72de20906db00868b68e1","observation_id":"bee24ced-75ec-4af9-b400-2dd06854b47a","resolution":{"observed_at":"2026-08-07T12:57:01.251723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-07T12:21:38.894445Z","title":"Anyv2v: A plug-and-play framework for any video-to-video editing tasks.arXiv preprint arXiv:2403.14468, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24873","last_updated":"2025-05-30T17:59:45Z","snapshot_observed_at":"2026-08-07T12:10:16.632008Z","submitted_at":"2025-05-30T17:59:45Z","title":"MiniMax-Remover: Taming Bad Noise Helps Video Object Removal","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:21:38.894445Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2505.24873"},"observation_digest":"sha256:889d0c0a60fe3329d31c65037429df3cb8dc67706467ecdeeb9ad948de7bd77a","observation_id":"6c689d82-3206-4d09-ad4a-bde261937c91","resolution":{"observed_at":"2026-08-07T12:21:38.894445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-07T11:14:43.028298Z","title":"AnyV2V: A tuning-free framework for any video-to-video editing tasks.arXiv:2403.14468, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03150","last_updated":"2025-06-03T17:59:52Z","snapshot_observed_at":"2026-08-09T04:47:45.249838Z","submitted_at":"2025-06-03T17:59:52Z","title":"IllumiCraft: Unified Geometry and Illumination Diffusion for Controllable Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:43.028298Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2506.03150"},"observation_digest":"sha256:5baa702dc1dc565f2da3399718b552087007bd1bc761113b5c79280315995c29","observation_id":"2fabdb75-2d0e-4d19-91d8-bd264dc12519","resolution":{"observed_at":"2026-08-07T11:14:43.028298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-07T10:51:42.896985Z","title":"Anyv2v: A plug-and-play framework for any video-to-video editing tasks.arXiv preprint arXiv:2403.14468, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04216","last_updated":"2025-06-04T17:57:43Z","snapshot_observed_at":"2026-08-08T15:17:23.629862Z","submitted_at":"2025-06-04T17:57:43Z","title":"UNIC: Unified In-Context Video Editing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:51:42.896985Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2506.04216"},"observation_digest":"sha256:5371d3981fd9123318f183e144bafe161f4f7675bfc6de8c1a4966a4a7784ece","observation_id":"9dce440a-792b-44e2-b720-3f83c195e9aa","resolution":{"observed_at":"2026-08-07T10:51:42.896985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-06T21:23:12.716870Z","title":"Max Ku, Cong Wei, Weiming Ren, Harry Yang, and Wenhu Chen","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00334","last_updated":"2025-07-01T00:21:24Z","snapshot_observed_at":"2026-08-07T23:57:01.785760Z","submitted_at":"2025-07-01T00:21:24Z","title":"Populate-A-Scene: Affordance-Aware Human Video Generation","version":1},"reference_index":1999,"source":"pdf_text","source_observed_at":"2026-08-06T21:23:12.716870Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2507.00334"},"observation_digest":"sha256:62514768b234c472422812c663ad49d265f4a7d70d8dda6bef79a031a71b8bfd","observation_id":"e35b201a-a990-4add-a86a-7cc744d679ba","resolution":{"observed_at":"2026-08-06T21:23:12.716870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-06T16:24:04.956206Z","title":"Anyv2v: A plug-and-play framework for any video- to-video editing tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.13753","last_updated":"2025-07-18T08:59:02Z","snapshot_observed_at":"2026-08-06T16:14:38.953158Z","submitted_at":"2025-07-18T08:59:02Z","title":"Encapsulated Composition of Text-to-Image and Text-to-Video Models for High-Quality Video Synthesis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:24:04.956206Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2507.13753"},"observation_digest":"sha256:087102ab93b9b948d4c6dd4cf9c71b71e2dac1e90c1ce928b4c3d78263e88622","observation_id":"a9ef22ac-c314-4987-9511-ed90bea7f57e","resolution":{"observed_at":"2026-08-06T16:24:04.956206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-05T18:34:26.325039Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14465","last_updated":"2025-08-20T06:40:34Z","snapshot_observed_at":"2026-08-07T20:12:58.792553Z","submitted_at":"2025-08-20T06:40:34Z","title":"DreamSwapV: Mask-guided Subject Swapping for Any Customized Video Editing","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T18:34:26.325039Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2508.14465"},"observation_digest":"sha256:12ef2f4709d558d2a835aa9c608b069914bb6277c46047ae61b1d3cf5b2d707b","observation_id":"ff7899b0-6abb-48e6-b21d-5061961a3b75","resolution":{"observed_at":"2026-08-05T18:34:26.325039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-05T18:29:00.311618Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14609","last_updated":"2025-08-20T10:51:24Z","snapshot_observed_at":"2026-08-08T03:42:14.649238Z","submitted_at":"2025-08-20T10:51:24Z","title":"AnchorSync: Global Consistency Optimization for Long Video Editing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T18:29:00.311618Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2508.14609"},"observation_digest":"sha256:4c46dc5d1fffa5c75458705dcd511f18af17c23abdcf893e1812df79e0641bbd","observation_id":"52016ab8-1fc7-4896-922d-a578c0224ad8","resolution":{"observed_at":"2026-08-05T18:29:00.311618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2509.04434","last_updated":"2026-04-06T12:49:32Z","snapshot_observed_at":"2026-07-06T22:24:08.755254Z","submitted_at":"2025-09-04T17:53:03Z","title":"Durian: Dual Reference Image-Guided Portrait Animation with Attribute Transfer","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T18:36:03.018873Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2509.04434"},"observation_digest":"sha256:b1fbc0d8db65965edc09be3fdb0b170f6c62756bac6e81a57b2ca229a509b6f1","observation_id":"6284085e-e2dc-42b9-b84b-d5a969822323","resolution":{"observed_at":"2026-05-18T18:36:43.997848Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2510.01186","last_updated":"2026-04-14T16:17:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-01T17:59:56Z","title":"ASTRA: Let Arbitrary Subjects Transform in Video Editing","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T10:13:10.141426Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2510.01186"},"observation_digest":"sha256:9000dc643f4d0bd2b2b9112323909b90bc9deee32f309f4c639aa3011bb35f47","observation_id":"42b81244-861c-4657-9eb0-94bb33d91527","resolution":{"observed_at":"2026-05-18T10:16:14.352502Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-04T10:49:48.197996Z","title":"Anyv2v: A tuning-free frame- work for any video-to-video editing tasks.arXiv preprint arXiv:2403.14468,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.08377","last_updated":"2026-07-03T16:46:11Z","snapshot_observed_at":"2026-08-07T16:29:46.498912Z","submitted_at":"2025-10-09T16:01:30Z","title":"UniVideo: Unified Understanding, Generation, and Editing for Videos","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T10:49:48.197996Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2510.08377"},"observation_digest":"sha256:b7e318a0c00779accc7577becd86ead6566ecd829a5e725f5c085601f82d1d6c","observation_id":"f1cd6c3b-2e50-46d2-969e-99bfb4bbf384","resolution":{"observed_at":"2026-08-04T10:49:48.197996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-03T19:54:48.653261Z","title":"Anyv2v: A tuning-free framework for any video-to- video editing tasks.arXiv preprint arXiv:2403.14468, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.22098","last_updated":"2026-07-16T03:47:27Z","snapshot_observed_at":"2026-08-03T19:54:46.253087Z","submitted_at":"2025-11-27T04:40:37Z","title":"WorldWander: Bridging Egocentric and Exocentric Worlds in Video Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T19:54:48.653261Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2511.22098"},"observation_digest":"sha256:e113792f6f1e0992a16f4aacfe7e30188e5af734b715fa7b141d3d31a400a6a2","observation_id":"1791fd2c-92a8-403c-a44e-1798ff14b9bf","resolution":{"observed_at":"2026-08-03T19:54:48.653261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-03T15:20:19.259415Z","title":"Anyv2v: A tuning-free framework for any video-to- video editing tasks.arXiv preprint arXiv:2403.14468, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17504","last_updated":"2026-06-29T14:03:15Z","snapshot_observed_at":"2026-08-08T15:15:50.787418Z","submitted_at":"2025-12-19T12:14:36Z","title":"InsertAnywhere: Geometrically Grounded and Optics-Aware Video Object Insertion","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T15:20:19.259415Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2512.17504"},"observation_digest":"sha256:4b49214146fdf0872851dcabd3e3b5e0866f77c286e82520d829bd895ae5394c","observation_id":"65e29d47-57ee-460c-a16b-65b95cfa6825","resolution":{"observed_at":"2026-08-03T15:20:19.259415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-13T22:49:23.002190Z","title":"arXiv preprint arXiv:2403.14468 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.17987","last_updated":"2026-07-06T18:38:47Z","snapshot_observed_at":"2026-08-03T23:57:14.086340Z","submitted_at":"2026-03-18T17:49:14Z","title":"On the Astrophysical Origin of Binary Black Hole Subpopulations: A Tale of Three Channels?","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-13T22:49:23.002190Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2603.17987"},"observation_digest":"sha256:9b4ae484851e6c1ef98dbb0d855ee06027a5775f913c12834cdfd99c39d75f75","observation_id":"9aa534d2-024c-4d4f-8cc2-d441ca33ed54","resolution":{"observed_at":"2026-07-13T22:49:23.002190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-03T02:31:00.643190Z","title":"arXiv preprint arXiv:2403.14468 (2024) 4 18 J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.01207","last_updated":"2026-07-31T06:47:55Z","snapshot_observed_at":"2026-08-08T14:14:42.520398Z","submitted_at":"2026-04-01T17:51:00Z","title":"TRACE: High-Fidelity 3D Scene Editing via Tangible Reconstruction and Geometry-Aligned Contextual Video Masking","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T02:31:00.643190Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2604.01207"},"observation_digest":"sha256:42cb9be19a2d5de44a08c270b4774f914b28abfaf9ea98c0be437e79d59cde39","observation_id":"34034540-a539-49e0-85b5-ee87b7fcb580","resolution":{"observed_at":"2026-08-03T02:31:00.643190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2604.08646","last_updated":"2026-04-09T17:59:02Z","snapshot_observed_at":"2026-07-06T22:57:40.773778Z","submitted_at":"2026-04-09T17:59:02Z","title":"InsEdit: Towards Instruction-based Visual Editing via Data-Efficient Video Diffusion Models Adaptation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T17:39:59.791758Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2604.08646"},"observation_digest":"sha256:805f002ff90e7d8f0afc53b83d6ed5d4ddb016a0509813efb96d0720f80471ba","observation_id":"53545e9a-efb2-47e2-86fd-d16d6c009e9a","resolution":{"observed_at":"2026-05-11T06:25:57.610688Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2604.11789","last_updated":"2026-04-20T14:38:53Z","snapshot_observed_at":"2026-08-09T05:10:13.009841Z","submitted_at":"2026-04-13T17:55:02Z","title":"LMMs Meet Object-Centric Vision: Understanding, Segmentation, Editing and Generation","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-10T15:35:37.095627Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2604.11789"},"observation_digest":"sha256:e9aed284d930ca86db9b2f9877d5b4a27aba0fbd4ec4e992854485c849fb4902","observation_id":"f7127b79-1d5e-4c34-b81d-8cbb01aac8c9","resolution":{"observed_at":"2026-05-11T10:11:06.055418Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2604.13425","last_updated":"2026-04-15T02:51:26Z","snapshot_observed_at":"2026-07-29T22:35:10.634628Z","submitted_at":"2026-04-15T02:51:26Z","title":"VibeFlow: Versatile Video Chroma-Lux Editing through Self-Supervised Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T13:15:35.258754Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2604.13425"},"observation_digest":"sha256:7be3caa752b5508c23697fb539101e9fa3ad7677f2c65459adca72deb9b160c8","observation_id":"66397050-cfb7-4480-89cc-75def287a1aa","resolution":{"observed_at":"2026-05-10T13:20:25.826889Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2604.13509","last_updated":"2026-04-15T05:52:43Z","snapshot_observed_at":"2026-08-09T02:08:05.382326Z","submitted_at":"2026-04-15T05:52:43Z","title":"DiT as Real-Time Rerenderer: Streaming Video Stylization with Autoregressive Diffusion Transformer","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T14:19:55.598710Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2604.13509"},"observation_digest":"sha256:e3b3fbb7960fbd498d9b8ad3b26f0ed1d09871d17c2788b47235a550a4f09718","observation_id":"abe3bbdc-a1a3-449c-a1d6-4ec858211036","resolution":{"observed_at":"2026-05-10T14:20:30.013596Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2604.19193","last_updated":"2026-04-21T08:04:02Z","snapshot_observed_at":"2026-08-02T22:05:18.077263Z","submitted_at":"2026-04-21T08:04:02Z","title":"How Far Are Video Models from True Multimodal Reasoning?","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T02:44:52.920816Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2604.19193"},"observation_digest":"sha256:0178e38ae2e234cb8a2673879a9c37265b1bda5e0f8183bdde61ecedc1cd428e","observation_id":"e58883ef-2f62-4f55-b899-ea9d05938812","resolution":{"observed_at":"2026-05-11T12:51:04.287346Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2604.19741","last_updated":"2026-06-03T18:09:47Z","snapshot_observed_at":"2026-08-01T19:25:06.120681Z","submitted_at":"2026-04-21T17:59:03Z","title":"CityRAG: Stepping Into a City via Spatially-Grounded Video Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T02:10:54.935053Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2604.19741"},"observation_digest":"sha256:f919f2df911b948d046d1dd3b77769b2c19cefff5c5a5857711d22e3fc304571","observation_id":"911d2e4f-bda8-420e-a7f5-9e3eb8834c41","resolution":{"observed_at":"2026-05-11T13:11:25.326302Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2604.21921","last_updated":"2026-04-23T17:58:38Z","snapshot_observed_at":"2026-07-06T23:08:23.939574Z","submitted_at":"2026-04-23T17:58:38Z","title":"Context Unrolling in Omni Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-09T22:02:57.841111Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2604.21921"},"observation_digest":"sha256:bd80812d25d954a41b542f47ee82e3ad1e50465fff9b4c4e7b93aa2b845f11f2","observation_id":"f3d3e354-f468-4703-bfa4-d9823cabcfa0","resolution":{"observed_at":"2026-05-11T14:21:04.888451Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2605.04569","last_updated":"2026-05-28T14:50:27Z","snapshot_observed_at":"2026-07-06T23:17:18.486586Z","submitted_at":"2026-05-06T07:15:29Z","title":"LIVEditor-14B: Lightning Unified Video Editing via In-Context Sparse Attention","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-01T00:24:30.573122Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2605.04569"},"observation_digest":"sha256:ba5729131b0e18e241d7a26596889a32ad93e655d551e0cd60dacefff8923824","observation_id":"4f8107cc-9958-40e1-8d8d-1544e1273b6b","resolution":{"observed_at":"2026-07-01T00:25:09.267051Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2605.12271","last_updated":"2026-05-26T13:34:33Z","snapshot_observed_at":"2026-08-03T01:41:22.691646Z","submitted_at":"2026-05-12T15:35:34Z","title":"Beyond Text Prompts: Visual-to-Visual Generation as A Unified Paradigm","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T06:02:39.114660Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2605.12271"},"observation_digest":"sha256:487bb24d4414b7a42f88156fe4a642d45a46a22e294b5918f69797d2548c1ff7","observation_id":"98231f1a-5174-4ba5-8a1d-237847c69381","resolution":{"observed_at":"2026-05-13T06:07:22.995370Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2605.12271","last_updated":"2026-05-26T13:34:33Z","snapshot_observed_at":"2026-08-03T01:41:22.691646Z","submitted_at":"2026-05-12T15:35:34Z","title":"Beyond Text Prompts: Visual-to-Visual Generation as A Unified Paradigm","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T22:18:55.933311Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2605.12271"},"observation_digest":"sha256:cae86525c1e657feed9f3e304456e41cbb5bc76b8df3d54017e5417db9e03d25","observation_id":"6e5cccbd-516b-4e97-8fe9-1cc14bde0e01","resolution":{"observed_at":"2026-07-01T14:05:46.606255Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2605.14136","last_updated":"2026-05-13T21:39:50Z","snapshot_observed_at":"2026-07-06T23:25:34.835136Z","submitted_at":"2026-05-13T21:39:50Z","title":"TeDiO: Temporal Diagonal Optimization for Training-Free Coherent Video Diffusion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T04:59:34.046044Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2605.14136"},"observation_digest":"sha256:dacc270f8b10f8bebab0dad6a3f4d4681a89bb1bde649f6778dbcac7e1516cb4","observation_id":"564e41d8-bd86-4bc6-acc0-ea66b829a297","resolution":{"observed_at":"2026-05-15T04:59:45.001367Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2605.17019","last_updated":"2026-05-16T14:45:32Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T14:45:32Z","title":"StreamingEffect: Real-Time Human-Centric Video Effect Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-19T20:11:47.359922Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2605.17019"},"observation_digest":"sha256:2de4d1e40ff2ecccfbdb0ae5ec09cc38c5827de1fb798bed77a5fc00d248965e","observation_id":"1d165a4e-e0b3-4c0c-beee-826f66a5f5aa","resolution":{"observed_at":"2026-05-19T20:12:44.720823Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2605.17312","last_updated":"2026-05-17T08:03:53Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T08:03:53Z","title":"VISTA: Triplet-Supervised Video Style Transfer with Diffusion Transformers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T14:14:41.662856Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2605.17312"},"observation_digest":"sha256:88aa417257912581277df26b7cd5c7eb2257c990f93fd1290272e36a7eb3753c","observation_id":"60822c2f-8784-41b8-a1f3-dfa3d3551e0d","resolution":{"observed_at":"2026-05-20T14:18:21.347758Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2605.18678","last_updated":"2026-05-20T11:14:23Z","snapshot_observed_at":"2026-08-04T16:01:22.114748Z","submitted_at":"2026-05-18T17:18:24Z","title":"Lance: Unified Multimodal Modeling by Multi-Task Synergy","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-20T11:46:52.658984Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2605.18678"},"observation_digest":"sha256:09f605dcc3ea7827ef1e0f59a397421daff68753beabd94a10b0f70671d1286c","observation_id":"5079c979-af34-4e4e-bf38-429b488df4cf","resolution":{"observed_at":"2026-05-20T11:48:15.022516Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2605.18678","last_updated":"2026-05-20T11:14:23Z","snapshot_observed_at":"2026-08-04T16:01:22.114748Z","submitted_at":"2026-05-18T17:18:24Z","title":"Lance: Unified Multimodal Modeling by Multi-Task Synergy","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-21T07:56:34.034047Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2605.18678"},"observation_digest":"sha256:d2dcda4fd60e9fe3bf7d231e7d6b1af95c46c446f48d96b97a55f1b18dc12bb7","observation_id":"5557a68d-39cc-45bc-8e98-f18b1d8cc77d","resolution":{"observed_at":"2026-05-21T07:59:50.724598Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2605.21466","last_updated":"2026-06-30T17:59:52Z","snapshot_observed_at":"2026-08-02T01:16:29.352385Z","submitted_at":"2026-05-20T17:52:10Z","title":"StreamEdit: Training-Free Video Editing via Few-Step Streaming Video Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-21T04:53:55.386923Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2605.21466"},"observation_digest":"sha256:99536c59bac48115530abb93bf206818239f29eba98d12a98b5e42aaa38cf719","observation_id":"051500b7-2c63-4fbe-9fab-96e780089747","resolution":{"observed_at":"2026-05-21T04:53:57.724009Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2605.21466","last_updated":"2026-06-30T17:59:52Z","snapshot_observed_at":"2026-08-02T01:16:29.352385Z","submitted_at":"2026-05-20T17:52:10Z","title":"StreamEdit: Training-Free Video Editing via Few-Step Streaming Video Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-01T07:49:06.391436Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2605.21466"},"observation_digest":"sha256:18fba4c261289f0bb43c808f4b2ac9835c0fef7f6112e9442d2b5160255476ed","observation_id":"44ebe1e2-06e8-46b9-9e36-dc965510a714","resolution":{"observed_at":"2026-07-01T07:55:30.969985Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2605.23192","last_updated":"2026-05-27T07:47:23Z","snapshot_observed_at":"2026-07-06T23:33:24.215365Z","submitted_at":"2026-05-22T03:19:24Z","title":"Occlusion-Aware Physics-Semantic Keyframe Selection for Robust Video Editing","version":1},"reference_index":118,"source":"arxiv_source","source_observed_at":"2026-05-25T05:00:31.868653Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2605.23192"},"observation_digest":"sha256:70ac3e2460a8c56ff8ad2722bd73a260c38778293ec88f4c830e9b0cebbd5727","observation_id":"beef785f-9b0d-4368-af78-65677e79b0c8","resolution":{"observed_at":"2026-05-25T05:06:38.708941Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2605.23245","last_updated":"2026-05-22T05:28:56Z","snapshot_observed_at":"2026-07-06T23:33:29.550551Z","submitted_at":"2026-05-22T05:28:56Z","title":"SimInsert: Seamless Video Object Insertion via Regional Sparse Attention Fusion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-25T04:46:50.749223Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2605.23245"},"observation_digest":"sha256:c2756a7da29a25a676a4d86bab5955017d45938667134f55e4ab3a5b8da87ae0","observation_id":"0b5a0162-06e7-4c93-add7-77237133a5c3","resolution":{"observed_at":"2026-05-25T04:50:21.453771Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2605.24674","last_updated":"2026-05-23T17:22:14Z","snapshot_observed_at":"2026-08-07T07:22:50.887133Z","submitted_at":"2026-05-23T17:22:14Z","title":"Reasoning to Align: Implicit Reasoning in Diffusion Transformers for Video Editing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T13:37:09.892339Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2605.24674"},"observation_digest":"sha256:90535c34691691a89068cde568462022f52312900ef87e1a7a2256f53539a0cf","observation_id":"84d0d923-79ef-4056-be76-6274044704f2","resolution":{"observed_at":"2026-06-30T13:44:41.110753Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2605.25193","last_updated":"2026-05-29T13:55:41Z","snapshot_observed_at":"2026-08-02T06:28:29.008131Z","submitted_at":"2026-05-24T17:50:45Z","title":"SpongeBob: Sync-Aware Harmonious Audio-Visual Generative Editing","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T12:07:44.914337Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2605.25193"},"observation_digest":"sha256:37bcb135b0a4758f3113fa5f8bd0d5be491ef6f700821569ce214e8d5e294abb","observation_id":"e4640dc1-02b0-4da2-ba03-df97e70a926a","resolution":{"observed_at":"2026-06-30T12:34:39.542651Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2606.01362","last_updated":"2026-05-31T17:33:14Z","snapshot_observed_at":"2026-08-02T17:53:31.376798Z","submitted_at":"2026-05-31T17:33:14Z","title":"AlbedoEdit: Unified Instance-Level Video Editing with Albedo Guidance","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T15:55:23.583463Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2606.01362"},"observation_digest":"sha256:fde987315924b45d92dbd9d8e711c3389b65eda90ed48c7b0a31462a860d4682","observation_id":"315cd38c-851b-49f0-b52d-c3f603e0bbe1","resolution":{"observed_at":"2026-07-01T21:56:16.320559Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2606.01399","last_updated":"2026-05-31T18:45:11Z","snapshot_observed_at":"2026-07-06T23:41:58.121923Z","submitted_at":"2026-05-31T18:45:11Z","title":"PAI-Studio: Cinematic Video Background Replacement with Camera-Aware Motion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T17:14:23.336848Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2606.01399"},"observation_digest":"sha256:18c9e4a126cdde723d60eb6f5ae1ce335aa0c154898c21e43557c47465150498","observation_id":"87dda0cd-56ce-44d9-bee6-37ee22ea1778","resolution":{"observed_at":"2026-07-01T21:16:14.768959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2606.22042","last_updated":"2026-06-20T13:47:39Z","snapshot_observed_at":"2026-08-05T13:19:43.915662Z","submitted_at":"2026-06-20T13:47:39Z","title":"IDAG-Edit: Multi-Object Video Editing via Instance-Decoupled Attention and Guidance","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T12:43:34.724121Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2606.22042"},"observation_digest":"sha256:716aaa015cf78515d50469e199df59941478c7309c6a2134b10651bd1922f6d4","observation_id":"2fd1bcb0-2cac-4c97-8393-b070b931ec90","resolution":{"observed_at":"2026-07-04T07:49:39.360807Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2606.23254","last_updated":"2026-06-22T12:37:15Z","snapshot_observed_at":"2026-08-05T22:00:16.486446Z","submitted_at":"2026-06-22T12:37:15Z","title":"SteerVTE: Seamless Video Text Editing with Style and Glyph Control","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T08:52:23.330736Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2606.23254"},"observation_digest":"sha256:bd455fb837eba18a8acb95efb0b064079a9c08d8f6c3080b84000d6946cbb825","observation_id":"e60b96ff-866e-42f0-916a-f4d686669f78","resolution":{"observed_at":"2026-07-04T10:29:44.543311Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2606.29020","last_updated":"2026-06-27T17:38:21Z","snapshot_observed_at":"2026-07-07T00:03:02.476882Z","submitted_at":"2026-06-27T17:38:21Z","title":"Semantic-Aware, Physics-Informed, Geometry-Grounded Weather Video Synthesis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-30T09:19:50.748415Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2606.29020"},"observation_digest":"sha256:baf013f7d1266efee09342daee855387f36b57388479bbd196c75554fa74e6c8","observation_id":"418902ff-166c-4076-8709-e4b7cac6246e","resolution":{"observed_at":"2026-06-30T09:24:32.485372Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2606.30599","last_updated":"2026-06-30T16:06:04Z","snapshot_observed_at":"2026-07-07T00:04:25.385438Z","submitted_at":"2026-06-29T17:38:15Z","title":"Goku: A Million-Scale Universal Dataset and Benchmark for Instruction-Based Video Editing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T06:00:24.487104Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2606.30599"},"observation_digest":"sha256:856f2915f5b3bf60de8f7e87775202b76d74f79e7df98f98a8106c8fc752e491","observation_id":"c6522794-663f-4da3-95e5-8a4822da822a","resolution":{"observed_at":"2026-06-30T06:04:21.462361Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":"2403.14468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-07-04T10:29:44.541818Z","title":"arXiv preprint arXiv:2403.14468 , year=","venue":null,"work_id":"91372074-cd42-4426-bf90-2d27dee1a1c9","year":2024},"citing_paper":{"arxiv_id":"2606.30599","last_updated":"2026-06-30T16:06:04Z","snapshot_observed_at":"2026-07-07T00:04:25.385438Z","submitted_at":"2026-06-29T17:38:15Z","title":"Goku: A Million-Scale Universal Dataset and Benchmark for Instruction-Based Video Editing","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-01T06:35:16.951243Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2606.30599"},"observation_digest":"sha256:b913bfc8eee7489a47edf3a757fa07b7797c3fc580b7984ea8f9771353113ea3","observation_id":"22005e8a-3d22-4398-86cb-aab700b18796","resolution":{"observed_at":"2026-07-01T06:35:29.287853Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-01T07:05:01.803198Z","title":"arXiv preprint arXiv:2403.14468 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21580","last_updated":"2026-07-23T17:56:30Z","snapshot_observed_at":"2026-08-01T14:54:11.706877Z","submitted_at":"2026-07-23T17:56:30Z","title":"GraphVid: Interactive Graph-Controllable Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T07:05:01.803198Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2607.21580"},"observation_digest":"sha256:11b1a83f9a6a4d3b64d62ee8807fc4823f537072b82b537abac5a1f5a2d0e2a7","observation_id":"e97ee9cf-072f-4590-93f4-57f4fafd8e3a","resolution":{"observed_at":"2026-08-01T07:05:01.803198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-03T03:17:55.406181Z","title":"arXiv preprint arXiv:2403.14468 (2024) 4, 10, 11","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29627","last_updated":"2026-07-31T16:59:46Z","snapshot_observed_at":"2026-08-05T23:16:09.548439Z","submitted_at":"2026-07-31T16:59:46Z","title":"FlexComposer: Unified Video Compositing from Images to Dynamic Footage with Flexible Trajectory Control","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T03:17:55.406181Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2607.29627"},"observation_digest":"sha256:b8e5ce655a0b0ebc5ee17821b63f1d132e31e799c512a86ddea04ef98be3649b","observation_id":"5009df36-1b13-4923-8cfc-12280f02a7f4","resolution":{"observed_at":"2026-08-03T03:17:55.406181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-08T12:16:44.707094Z","title":"Anyv2v: A tuning-free framework for any video-to- video editing tasks.arXiv preprint arXiv:2403.14468, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T06:11:21.838012Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.707094Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:4fe14220b7a0aaab2c884befa12c3acf0ef1c7a925d23229f0e5c7e718646696","observation_id":"19bb3541-0439-4422-9c09-67e0f00c4524","resolution":{"observed_at":"2026-08-08T12:16:44.707094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-08T04:54:58.661523Z","title":"Anyv2v: A tuning-free framework for any video-to-video editing tasks.arXiv preprint arXiv:2403.14468,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-09T06:11:45.805286Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.661523Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:7b4d2f6fa0461a185261729b55aa5be6690a34174e213b4359f776abe2e15e89","observation_id":"91ea9fcc-b054-465a-9e74-1cafd7393850","resolution":{"observed_at":"2026-08-08T04:54:58.661523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2403.14468/citation-record","integrity":"/paper/2403.14468/integrity","json":"/paper/2403.14468/citation-record.json","paper":"/paper/2403.14468"},"outbound":[],"paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 48 inbound Pith citation observations for arXiv:2403.14468."}