{"as_of":"2026-08-07T11:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c418945e05b7eb068ce0b1be90d2ffba2b5cd762688b8ee2954d8d0eb57fcec0","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T10:34:42.436470Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05049/citation-record","integrity":"/paper/2608.05049/integrity","json":"/paper/2608.05049/citation-record.json","paper":"/paper/2608.05049"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:42.160944Z","title":"Scaling instruction-based video editing with a high-quality synthetic dataset.arXiv preprint arXiv:2510.15742, 2025","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.160944Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:418cea90e37d98e1164f240fc7f531c066cc3a5d17a0de0cd91d2eec94fed94a","observation_id":"5d3d4a54-6833-4c59-a995-43cc7526624c","resolution":{"observed_at":"2026-08-06T10:34:42.160944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:42.168101Z","title":"Instructpix2pix: Learning to follow image editing instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.168101Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:1ca6a8194cc03a00a5d6a04a8d0d563a1a7c69b0ef8c83f39933a4325647173f","observation_id":"d0aed58d-8847-4e1f-9b78-9d6e154df486","resolution":{"observed_at":"2026-08-06T10:34:42.168101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:42.175141Z","title":"Anydoor: Zero-shot object-level image customization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.175141Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:a469c1118ffcb022ca7e5167e38be9078566731d259fd9c7cc0d9080c0508a80","observation_id":"3248012e-f924-442c-8fd9-f5ae94e4626c","resolution":{"observed_at":"2026-08-06T10:34:42.175141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:43.892807Z","title":"Unireal: Universal image generation and editing via learning real-world dynamics","venue":null,"work_id":"6dc51a12-a269-4a8f-90c1-06455f7d1bf6","year":2025},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.186546Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:d821da500377fc65ecea6907b64966f32e3a404cba05e50b64e20b290450c21a","observation_id":"751deed3-846c-4ebb-ae84-a36b2a960359","resolution":{"observed_at":"2026-08-06T10:34:43.902237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:42.194369Z","title":"Ivebench: Modern benchmark suite for instruction-guided video editing assessment.arXiv preprint arXiv:2510.11647, 2025","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.194369Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:2e93ba45cc0f1fc7c5bdf3d6a2f30e28e0375c537bc4234cc503e5f9831b2c10","observation_id":"f7c5eef8-ebd4-4901-aa61-a5f37e59ba85","resolution":{"observed_at":"2026-08-06T10:34:42.194369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:43.866071Z","title":"Editboard: Towards a comprehensive evaluation benchmark for text-based video editing models","venue":null,"work_id":"58cf4266-1cc2-4f52-a11e-ce89e8c47814","year":2025},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.200216Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:b6d5e1f5ecf55b1542069b81798f80575e7c788891467dc192d28cdaae559549","observation_id":"86727b83-e394-4254-bcff-8448dda4d872","resolution":{"observed_at":"2026-08-06T10:34:43.871440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:42.205665Z","title":"Wan-animate: Unified character animation and replacement with holistic replication","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.205665Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:685c17788e302437c37f2646f9fe5d9fcc49c78b08599dcd4ea325bbe5adf79e","observation_id":"e485d5ab-dd59-4ee1-a47d-2a71a16f080d","resolution":{"observed_at":"2026-08-06T10:34:42.205665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:42.211770Z","title":"Viva: Vlm-guided instruction-based video editing with reward optimization.arXiv preprint arXiv:2512.16906, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.211770Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:8d08a7f4dfa5b6220557dd4379753bc42c2d566eb8a2feced7b9791a48989b00","observation_id":"e31b5ca5-0363-48b8-8f11-ad4b940fe214","resolution":{"observed_at":"2026-08-06T10:34:42.211770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-06T10:34:42.218252Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning.arXiv preprint arXiv:2307.04725, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.218252Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:31564f295c2fda30080afe075cec06215469630a6f1c26e7442ba82a8fdcae26","observation_id":"954ef4b2-db87-48ae-a70a-6ee9660879c8","resolution":{"observed_at":"2026-08-06T10:34:42.218252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:42.224741Z","title":"Openve-3m: A large-scale high-quality dataset for instruction-guided video editing.arXiv preprint arXiv:2512.07826, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.224741Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:ce546c82217c535fed206d58b432deeabfa47d3286a0b8c636d54a59b21bef20","observation_id":"b59d8b1c-5ee0-4a1c-99f2-fe329d646a3a","resolution":{"observed_at":"2026-08-06T10:34:42.224741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-06T10:34:42.230863Z","title":"Prompt-to- prompt image editing with cross attention control.arXiv preprint arXiv:2208.01626, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.230863Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:d4d9a5dc8cabf66abfa05667a140217daab044c1c1f49bcd3a6bbbe8b8a68d2d","observation_id":"65b7d1fe-ad68-492d-9c7a-28a1dfdda58f","resolution":{"observed_at":"2026-08-06T10:34:42.230863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:43.841730Z","title":"Clipscore: A reference-free evaluation metric for image captioning","venue":null,"work_id":"6fad9c55-eba6-4b4d-9fc8-7002c1103519","year":2021},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.236409Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:1b9eee638dcaeca9d2e043a45df59e6fdc45964d204c92f64543517e714dd4c9","observation_id":"205b51f1-8ecc-4b5b-a7c0-caf6bbbea113","resolution":{"observed_at":"2026-08-06T10:34:43.849231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:42.241324Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.241324Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:5fac8d1b64ff87a722cfcd515d2ad21e9d0acf63c0bc0f19d319191bb4fc6199","observation_id":"bc5d1c4e-1705-4178-8ec0-d931a980ddd5","resolution":{"observed_at":"2026-08-06T10:34:42.241324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:42.247039Z","title":"Video diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.247039Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:19836305e205106d66449a080981f917e7e771de65edb8df1261fcae3c7c2a39","observation_id":"619bc456-c68a-4177-9c0d-8640e90637dd","resolution":{"observed_at":"2026-08-06T10:34:42.247039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:43.783371Z","title":"Image quality metrics: Psnr vs","venue":null,"work_id":"55cac230-a6f2-4b5e-a772-768532aca759","year":2010},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.252154Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:45a5802f278a2dc126f3b5b6512d3aa5031755adf93c6b10cb668eb224f992eb","observation_id":"104df2ec-e11b-4213-8eb7-4ae911f5832a","resolution":{"observed_at":"2026-08-06T10:34:43.793896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:42.257006Z","title":"VBench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.257006Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:ae58c95807e3a47fe552d8ce0ce59b1d229b52a06fa2015b72759d8d696a20d4","observation_id":"f488f162-a02a-4922-9948-bf4e2c2cd97c","resolution":{"observed_at":"2026-08-06T10:34:42.257006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:43.739014Z","title":"Image-to-image translation with conditional adversarial networks","venue":null,"work_id":"32ff6c2f-e70a-4628-9ec4-a737528b9592","year":2017},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.261466Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:e7f83b162a0eee92a4735fc4895dfd1b1a18e98e957418625e17daa90722cf01","observation_id":"2a10632f-24ec-4ebe-8e15-d88aada0e913","resolution":{"observed_at":"2026-08-06T10:34:43.745938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:42.266985Z","title":"Smarteraser: Remove anything from images using masked-region guidance","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.266985Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:a033ef916eeb0d3e9ba6696a936c9ffb77ff04c8495746961917e9e567052f11","observation_id":"c06688bc-af8f-4b50-9679-4669715906a7","resolution":{"observed_at":"2026-08-06T10:34:42.266985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:43.700646Z","title":"Hifi-gan: Generative adversarial networks for efficient and high fidelity speech synthesis","venue":null,"work_id":"04ee2bcf-124d-4fe3-9c2f-379620156977","year":2020},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.272718Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:41a154082a5864ab8c906735099cc14b3a94f58def91f5f1aae38e27a9520349","observation_id":"088df2b4-c64c-4fb4-873d-1ba636be3200","resolution":{"observed_at":"2026-08-06T10:34:43.706308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15742","last_updated":"2025-06-24T05:31:03Z","snapshot_observed_at":"2026-07-06T21:44:22.901650Z","submitted_at":"2025-06-17T20:18:23Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.15742","snapshot_observed_at":"2026-08-06T10:34:42.277776Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.277776Z"},"links":{"cited_paper":"/paper/2506.15742","citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:70326cd5a2faf48bba10961d82aa4a2abfa80390ad6da7c65449badd4bdafc3c","observation_id":"b8d29152-0450-4279-8931-7ea43119e5dc","resolution":{"observed_at":"2026-08-06T10:34:42.277776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10018","last_updated":"2025-01-17T08:03:02Z","snapshot_observed_at":"2026-08-06T16:39:48.582832Z","submitted_at":"2025-01-17T08:03:02Z","title":"DiffuEraser: A Diffusion Model for Video Inpainting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10018","snapshot_observed_at":"2026-08-06T10:34:42.282859Z","title":"Diffueraser: A diffusion model for video inpainting","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.282859Z"},"links":{"cited_paper":"/paper/2501.10018","citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:7a8719943ca970979261d8b5403a33aa7cbf46956983e11f6df8950d10527bfd","observation_id":"925ecf7d-9758-4416-aa39-d615911335c9","resolution":{"observed_at":"2026-08-06T10:34:42.282859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:42.288789Z","title":"Flow matching for generative modeling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.288789Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:7159d75109a8b57f02b12c3bad691733a9af4407df56fbfe393405c0746ecfc4","observation_id":"0f9ea042-7a4e-48cd-8d6b-827a25e181d5","resolution":{"observed_at":"2026-08-06T10:34:42.288789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03003","last_updated":"2022-09-07T08:59:55Z","snapshot_observed_at":"2026-07-06T13:49:40.974495Z","submitted_at":"2022-09-07T08:59:55Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.03003","snapshot_observed_at":"2026-08-06T10:34:42.295281Z","title":"Flow straight and fast: Learning to generate and transfer data with rectified flow.arXiv preprint arXiv:2209.03003, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.295281Z"},"links":{"cited_paper":"/paper/2209.03003","citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:545887f77d977d03a3fb13e1b5b2fbe58ac9a5c4b4fc1395836ec6bf9046a7ba","observation_id":"e624bf4b-2d0c-47f3-b7ea-67123db03786","resolution":{"observed_at":"2026-08-06T10:34:42.295281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.09924","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:42.833755Z","title":"Revise: Towards reason-informed video editing in unified models with self-reflective learning.arXiv preprint arXiv:2512.09924, 2025","venue":null,"work_id":"c0068868-c877-4127-a504-9cc492d1073a","year":2025},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.301737Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:09f0b63875e5de8e3db23b2be1fc52a53cb4cc47b72451d4915aab054d1d79f3","observation_id":"dd549469-c9a2-4443-8d18-b6e3fca6d114","resolution":{"observed_at":"2026-08-06T10:34:42.843817Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:43.667354Z","title":"Rose: Remove objects with side effects in videos","venue":null,"work_id":"8618a6f9-509d-4b07-8e8a-85be498d85b0","year":2025},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.306380Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:4ea317c8c85e6e81164058904e7b94e8755ca87f5f2468cc348ee46ef25aea3d","observation_id":"701c8655-bc31-42b9-a13a-f5c97f89ae87","resolution":{"observed_at":"2026-08-06T10:34:43.673416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:42.312948Z","title":"Instructx: Towards unified visual editing with mllm guidance.arXiv preprint arXiv:2510.08485, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.312948Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:e066f097ed6fcab6a1a9898fa2f8fdb9bd53cdd442e2d63336b77e035f26230f","observation_id":"5f6b8981-a998-4952-84b7-143734298229","resolution":{"observed_at":"2026-08-06T10:34:42.312948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.03499","last_updated":"2016-09-19T18:04:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-12T17:29:40Z","title":"WaveNet: A Generative Model for Raw Audio","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.03499","snapshot_observed_at":"2026-08-06T10:34:42.320029Z","title":"Wavenet: A generative model for raw audio","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.320029Z"},"links":{"cited_paper":"/paper/1609.03499","citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:0abf9fc7948cf4fad64f2aeeb946036826e926056c680711904a542f08be7bc1","observation_id":"19e6191c-48d5-47ee-8082-0187cad30f94","resolution":{"observed_at":"2026-08-06T10:34:42.320029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:42.327329Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.327329Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:d2ca94c71dbb3e5576ee1875e39b3c1b7d1e3282dc6ad464310f1e6515bc8169","observation_id":"c3255327-7463-4e44-9df2-d31ba697c007","resolution":{"observed_at":"2026-08-06T10:34:42.327329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:42.333706Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.333706Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:d534b790647fb11a1f6c4702ad0353ca9e2ebad0a806f0d530c5f7644fc63edb","observation_id":"55969f36-4dcc-4d18-b9ab-8d70781e95de","resolution":{"observed_at":"2026-08-06T10:34:42.333706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:43.625174Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":"522b7caf-dede-4332-b189-fa9b53c84dd8","year":2023},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.340644Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:1499caed915e8bbb6df72c7c3f6a2b200a011d9701beb1e4475e5503cd9bd9cb","observation_id":"ced7556d-dd3f-485d-93db-7171acfe71ec","resolution":{"observed_at":"2026-08-06T10:34:43.630151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:43.609130Z","title":"Runway aleph.https://runwayml.com, 2024","venue":null,"work_id":"ede78d46-5e97-46c5-8cea-1861b7cd227c","year":2024},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.345447Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:859e65da990fb6af3abf6763844981f708595447a606aba11f76baa04b3f9bd7","observation_id":"2f063f7b-2431-473f-b739-3a907d0478d8","resolution":{"observed_at":"2026-08-06T10:34:43.614082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:43.588574Z","title":"Photorealistic text-to- image diffusion models with deep language understanding","venue":null,"work_id":"25b35459-9d49-44b0-aaf9-5ff298805ab2","year":2022},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.352756Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:8d70b56d3ee3bd18d32fcc8b7bec8d87eb5d5923a415b1748a9b7eacd465aa70","observation_id":"63d34236-73eb-496a-91af-3bdc89048666","resolution":{"observed_at":"2026-08-06T10:34:43.593694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14148","last_updated":"2026-04-15T17:59:40Z","snapshot_observed_at":"2026-07-06T23:02:00.082783Z","submitted_at":"2026-04-15T17:59:40Z","title":"Seedance 2.0: Advancing Video Generation for World Complexity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14148","snapshot_observed_at":"2026-08-06T10:34:42.357223Z","title":"Seedance 2.0: Advancing video generation for world complexity","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.357223Z"},"links":{"cited_paper":"/paper/2604.14148","citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:6b33754bed477a9c218e011e75ab3c3a93af49197636f1a6903c2354b8566f66","observation_id":"b1095210-3e1e-4b61-a8f1-18d39295d9b8","resolution":{"observed_at":"2026-08-06T10:34:42.357223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-06T10:34:42.362070Z","title":"Denoising diffusion implicit models.arXiv preprint arXiv:2010.02502, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.362070Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:9a3d34696df93110233332a69bd5c7a3719740db50f0663fbb2b3032c8de75af","observation_id":"2603595d-64d4-4bfe-8c5a-8186492f6f57","resolution":{"observed_at":"2026-08-06T10:34:42.362070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:42.366827Z","title":"Kingma, Abhishek Kumar, Stefano Ermon, and Ben Poole","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.366827Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:473ed47ddb03ad7a8898e904a5da71e3d5d368e158022a44831e401e6700111c","observation_id":"8657c5f1-d640-43df-986e-9f1ae4cf2751","resolution":{"observed_at":"2026-08-06T10:34:42.366827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:43.547102Z","title":"Ve-bench: subjective-aligned benchmark suite for text-driven video editing quality assessment","venue":null,"work_id":"fabe3745-6063-4d3c-860d-6bd128da0e8f","year":2025},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.371360Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:c88932aaa90a88e76002343a2b5f9e394917ea9e88cffbd48e0108899cb6bf13","observation_id":"0ef098fd-b2e8-4091-9acb-40b97da0f40a","resolution":{"observed_at":"2026-08-06T10:34:43.552049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:43.524317Z","title":"Edtalk: Efficient disentanglement for emotional talking head synthesis","venue":null,"work_id":"6e581ea5-9f4d-4158-8bf9-ed763a9a1937","year":2024},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.376282Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:8d56c31bf91d52c10ba8cb065532878ac76bf3a3cc6b4dffe59048dd6f666019","observation_id":"4e3bde35-0935-4fea-9cfa-153dc33745cf","resolution":{"observed_at":"2026-08-06T10:34:43.530173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-06T10:34:42.381600Z","title":"Kling-omni technical report.arXiv preprint arXiv:2512.16776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.381600Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:5df212c4c785d2893b689110aa4e80c48a45187157282419d89fd1d8a9dcde09","observation_id":"00933cae-4ba2-402d-98a0-749e3ba91d9f","resolution":{"observed_at":"2026-08-06T10:34:42.381600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-06T10:34:42.386232Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.386232Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:5e45e5373f0957e01c65a6a88ebc296236df5f9ae692d65ceef2baa9e740f93d","observation_id":"47358edb-0ed8-4e95-872a-1c44e0097c52","resolution":{"observed_at":"2026-08-06T10:34:42.386232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:43.506457Z","title":null,"venue":null,"work_id":"8969d274-6233-4c1a-9a4f-9cbd8b9beb2e","year":2004},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.392159Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:a8cac0c04c5c99eb7ebfe5ee3c76ba71354e6bf09b196c49d1a17aba5e6fd3f0","observation_id":"357ea080-a199-466f-87b2-9a5d2f6b5bb9","resolution":{"observed_at":"2026-08-06T10:34:43.511923Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08377","last_updated":"2026-07-03T16:46:11Z","snapshot_observed_at":"2026-08-04T10:49:46.339959Z","submitted_at":"2025-10-09T16:01:30Z","title":"UniVideo: Unified Understanding, Generation, and Editing for Videos","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.08377","snapshot_observed_at":"2026-08-06T10:34:42.397646Z","title":"Univideo: Unified understanding, generation, and editing for videos.arXiv preprint arXiv:2510.08377, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.397646Z"},"links":{"cited_paper":"/paper/2510.08377","citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:1b17db50ba3822e25909769e7861a5517ae273960b1efe261a1f4086b16c3d9f","observation_id":"10f85d00-c887-4d7d-b835-3a774a43a6de","resolution":{"observed_at":"2026-08-06T10:34:42.397646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:43.478346Z","title":"Grok imagine.https://x.ai, 2024","venue":null,"work_id":"75c7876c-0371-457a-bb3b-9161b2932a01","year":2024},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.402290Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:8d9e451754581eba7e7aa01b5c55f321017ee8c2d4e037e15cc8ed9ebff452ca","observation_id":"577fb355-b99d-4f8c-9ab8-7b385cb32d13","resolution":{"observed_at":"2026-08-06T10:34:43.489188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-06T10:34:42.407068Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer.arXiv preprint arXiv:2408.06072, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.407068Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:f20adca2239de0fd4f3744ed6d010e2ec6ac98430a2f69dfaf751fecdef3597b","observation_id":"8add0f7b-4ec7-4300-b73c-e47b76329c5f","resolution":{"observed_at":"2026-08-06T10:34:42.407068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:42.412964Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.412964Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:91de557adbbb78dceaa38f85973a8e31509b11c56e0f37bd2737289a076edc4c","observation_id":"3652adff-3020-433a-89ad-6ebccd3270c5","resolution":{"observed_at":"2026-08-06T10:34:42.412964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:43.447426Z","title":"Inversion-based style transfer with diffusion models","venue":null,"work_id":"8e45788a-1480-4574-9aa2-761fddec0dd2","year":2023},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.417454Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:996ce5e5cf10d88bf80ae9cbdc438b54bb8d755d1f8ab6aff1e8cd228d8f213e","observation_id":"79fba17a-de7f-497a-a309-47052f53ba5a","resolution":{"observed_at":"2026-08-06T10:34:43.452515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02826","last_updated":"2025-05-27T15:54:58Z","snapshot_observed_at":"2026-07-06T21:03:50.078667Z","submitted_at":"2025-04-03T17:59:56Z","title":"Envisioning Beyond the Pixels: Benchmarking Reasoning-Informed Visual Editing","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02826","snapshot_observed_at":"2026-08-06T10:34:42.421971Z","title":"Envisioning beyond the pixels: Benchmarking reasoning-informed visual editing.arXiv preprint arXiv:2504.02826, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.421971Z"},"links":{"cited_paper":"/paper/2504.02826","citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:b7d6c5d785035c6f6068c2c0ce58585faad4a174fcd308368290174c2a6ca342","observation_id":"a9ae70a9-910a-4579-8cb8-25e3ee96b58b","resolution":{"observed_at":"2026-08-06T10:34:42.421971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:42.427436Z","title":"Propainter: Improving propagation and transformer for video inpainting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.427436Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:169d5386ca5102864b155c6093cab07fcfa4c3b8be391760fd4b3968f08ec248","observation_id":"87392272-502c-4978-9de9-0602cac62504","resolution":{"observed_at":"2026-08-06T10:34:42.427436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:43.402113Z","title":"Unpaired image-to-image translation using cycle-consistent adversarial networks","venue":null,"work_id":"17c02b70-d8ed-410f-ba57-fd1f2ad90182","year":2017},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.432310Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:b3754605e7d28add8932f9cc9562ff32e23c021d32a96434fdf255a8ab94d33f","observation_id":"46d09fa3-b787-4543-b71d-18f58f1c06e6","resolution":{"observed_at":"2026-08-06T10:34:43.409613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:34:43.382215Z","title":"Señorita-2m: A high-quality instruction-based dataset for general video editing by video specialists","venue":null,"work_id":"3b392f69-9111-4c74-b00f-72a7c63251bd","year":2025},"citing_paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T10:34:42.436470Z"},"links":{"citing_paper":"/paper/2608.05049"},"observation_digest":"sha256:8592aa40760a34295629a4f961623b5b17644a9316c41a3517aa616e41bedd7d","observation_id":"1304d60f-6e60-4e0d-9a80-e1f03a6eccd5","resolution":{"observed_at":"2026-08-06T10:34:43.387144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.05049","last_updated":"2026-08-05T16:58:48Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T10:36:51.936977Z","submitted_at":"2026-08-05T16:58:48Z","title":"OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2608.05049."}