Pith. sign in

Paper Citation Record · LEDGER

OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

As of 15 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 19 inbound Pith citation observations for arXiv:2512.07826.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2512.07826 v3

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 19 of 19 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-15T06:32:42.880941+00:00

measured 19 of 19 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-07-01T06:35:16.951243Z

measured 1 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

0
arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 5b4764b9-d2bf-4e54-bbbd-843f1d49c663 · inbound

ImVideoEdit: Image-learning Video Editing via 2D Spatial Difference Attention Blocks cites this paper.

ImVideoEdit: Image-learning Video Editing via 2D Spatial Difference Attention Blocks OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-08-13T02:21:48.005953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-10T17:49:33.822264Z digest=sha256:a1d649e6716559e72c0a0059a85d3096e86f79e50719912412dc633b3b7ace4c

Observation fad165c7-2943-465b-bc3f-e31ed0a41bf6 · inbound

InsEdit: Towards Instruction-based Visual Editing via Data-Efficient Video Diffusion Models Adaptation cites this paper.

InsEdit: Towards Instruction-based Visual Editing via Data-Efficient Video Diffusion Models Adaptation OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

Reference 10

Resolution
verified exact
arxiv_id, observed 2026-08-13T02:21:48.005953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-10T17:39:59.791758Z digest=sha256:abe28c1f39169a5c61ba1ba09c38bd5568c778867a6597d46febfc9e2050a7e9

Observation 2d61b83f-1478-4500-afd6-b66de4be8234 · inbound

VEFX-Bench: A Holistic Benchmark for Generic Video Editing and Visual Effects cites this paper.

VEFX-Bench: A Holistic Benchmark for Generic Video Editing and Visual Effects OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

Reference 16

Resolution
metadata mismatch
arxiv_id, observed 2026-08-13T02:21:48.005953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-10T08:24:41.925800Z digest=sha256:c27a8ed6dc1dc41a4c67c1ae6ec56ff64b422ef7863d280207e933e06646bbc9

Observation 163539ef-aa74-4de0-9825-9fedb467eb25 · inbound

LIVE: Leveraging Image Manipulation Priors for Instruction-based Video Editing cites this paper.

LIVE: Leveraging Image Manipulation Priors for Instruction-based Video Editing OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

Reference 11

Resolution
verified exact
arxiv_id, observed 2026-08-13T02:21:48.005953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-10T07:21:41.483427Z digest=sha256:ef1b05eae88fec26d75ee59480f0b2f0bc5754083f807a2c345419921d6f7cdd

Observation 09227181-e68c-485b-b41f-72da79208551 · inbound

How Far Are Video Models from True Multimodal Reasoning? cites this paper.

How Far Are Video Models from True Multimodal Reasoning? OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

Reference 21

Resolution
verified exact
arxiv_id, observed 2026-08-13T02:21:48.005953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-10T02:44:52.920816Z digest=sha256:4793b3b2d58d655875ed673c9691fbb0e98ea8322d3d4e5dbac4fb5c4bee9ac8

Observation 90bc9793-19af-40b6-a9a6-bc09157d5a61 · inbound

Mamoda2.5: Enhancing Unified Multimodal Model with DiT-MoE cites this paper.

Mamoda2.5: Enhancing Unified Multimodal Model with DiT-MoE OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

Reference 37

Resolution
verified exact
arxiv_id, observed 2026-08-13T02:21:48.005953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-08T18:26:58.696936Z digest=sha256:0e89aa9959bf4432f9216df01c19497641a2191da99f30aa436c18b7f6280894

Observation 89252370-c0c1-47fe-9454-4cd4f90611b4 · inbound

Sparkle: Realizing Lively Instruction-Guided Video Background Replacement via Decoupled Guidance cites this paper.

Sparkle: Realizing Lively Instruction-Guided Video Background Replacement via Decoupled Guidance OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-08-13T02:21:48.005953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-08T12:34:34.315135Z digest=sha256:cc9a14779d30b181831f165900a74480a7bc2d329885b3156a7c132dd31998a7

Observation 31a4e36b-58de-41fd-ab58-9bddadf5c2e5 · inbound

MiVE: Multiscale Vision-language features for reference-guided video Editing cites this paper.

MiVE: Multiscale Vision-language features for reference-guided video Editing OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

Reference 32

Resolution
verified exact
arxiv_id, observed 2026-08-13T02:21:48.005953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-05-15T05:23:20.179387Z digest=sha256:588eb13e9bb759f213cc01232d0840c3ebcaa0d531133c21a17417fdb3288e60

Observation 3fabf862-66be-4a5e-95ba-f7e18d49f3d4 · inbound

Aurora: Unified Video Editing with a Tool-Using Agent cites this paper.

Aurora: Unified Video Editing with a Tool-Using Agent OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

Reference 11

Resolution
verified exact
arxiv_id, observed 2026-08-13T02:21:48.005953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-20T10:47:05.038308Z digest=sha256:cbe2a4ea6a80cac3796ad5bed28b560f4e418b5d0f6e44671bf744f285f4d0be

Observation 3454d3fc-a24e-40b7-a483-c19beff2916e · inbound

Bernini: Latent Semantic Planning for Video Diffusion cites this paper.

Bernini: Latent Semantic Planning for Video Diffusion OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

Reference 26

Resolution
verified exact
arxiv_id, observed 2026-08-13T02:21:48.005953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-22T06:39:47.124605Z digest=sha256:dd73b1bf9078b91f2c9178ee00f0c911c34aa7e189ef86a27ea2f27fb31e1053

Observation ef47b832-69ec-45ab-a414-aafe309df72e · inbound

Occlusion-Aware Physics-Semantic Keyframe Selection for Robust Video Editing cites this paper.

Occlusion-Aware Physics-Semantic Keyframe Selection for Robust Video Editing OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

Reference 113

Resolution
verified exact
arxiv_id, observed 2026-08-13T02:21:48.005953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-05-25T05:00:31.868653Z digest=sha256:28cf829f9881bcc870c23e94fb278f178a97fd3e036e7a20c41627895b53fadf

Observation fd161cf9-f099-4143-9fee-3d6793b67fa6 · inbound

Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework cites this paper.

Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

Reference 35

Resolution
metadata mismatch
arxiv_id, observed 2026-08-13T02:21:48.005953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-25T04:30:20.593882Z digest=sha256:aafae140d92ac6e95eb6112ea53dff1017d4dab5a14ef9ced7b1e09b10ea8d5d

Observation e9949324-eddf-4d1a-b73b-e8cff83c90a0 · inbound

Reasoning to Align: Implicit Reasoning in Diffusion Transformers for Video Editing cites this paper.

Reasoning to Align: Implicit Reasoning in Diffusion Transformers for Video Editing OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

Reference 18

Resolution
verified exact
arxiv_id, observed 2026-08-13T02:21:48.005953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-06-30T13:37:09.892339Z digest=sha256:73dee84ee46547a0369529db86582b39d3d3436f52c29fe36396933b8e27958c

Observation 5261f483-5f19-4697-b315-9cd606b3758a · inbound

SpongeBob: Sync-Aware Harmonious Audio-Visual Generative Editing cites this paper.

SpongeBob: Sync-Aware Harmonious Audio-Visual Generative Editing OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

Reference 4

Resolution
verified exact
arxiv_id, observed 2026-08-13T02:21:48.005953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-06-30T12:07:44.914337Z digest=sha256:68e55d80aa16707bd655e1c784a809f094a688e6fd0044763b6237dad0bc4b95

Observation e919bf8e-c76f-44b7-bd97-a8db6fb94c7e · inbound

DualEraser: Joint Video Object and Effect Removal via Balanced Text-Mask Guidance and Decoupled Locator-Preserver cites this paper.

DualEraser: Joint Video Object and Effect Removal via Balanced Text-Mask Guidance and Decoupled Locator-Preserver OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

Reference 9

Resolution
metadata mismatch
arxiv_id, observed 2026-08-13T02:21:48.005953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-06-29T08:06:27.191812Z digest=sha256:fea682c668ecd57ee7fd6cd6a5ca6ab4a9ee0025213dcac719b3aa370cf22a8f

Observation 7e285cf4-547e-4eaa-815b-bb18befc6161 · inbound

SANA-Streaming: Real-time Streaming Video Editing with Hybrid Diffusion Transformer cites this paper.

SANA-Streaming: Real-time Streaming Video Editing with Hybrid Diffusion Transformer OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

Reference 14

Resolution
verified exact
arxiv_id, observed 2026-08-13T02:21:48.005953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-06-29T07:39:41.553623Z digest=sha256:0f0335ed588e4680ee29abfb5946db9ebaf75932d9625b572d0a1b7f4d5c57c9

Observation 18a0ee24-8692-4f78-8519-c5aa8200a789 · inbound

JAVEDIT: Joint Audio-Visual Instruction-Guided Video Editing with Agentic Data Curation cites this paper.

JAVEDIT: Joint Audio-Visual Instruction-Guided Video Editing with Agentic Data Curation OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

Reference 2

Resolution
verified exact
arxiv_id, observed 2026-08-13T02:21:48.005953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-06-28T11:04:49.366127Z digest=sha256:f4f66c637e5a56462b18db8923382216ac642c47a1608beeb102ed246f73d82c

Observation 257a4673-cc77-47ee-9851-28518962325e · inbound

Goku: A Million-Scale Universal Dataset and Benchmark for Instruction-Based Video Editing cites this paper.

Goku: A Million-Scale Universal Dataset and Benchmark for Instruction-Based Video Editing OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-08-13T02:21:48.005953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-06-30T06:00:24.487104Z digest=sha256:7f929960b3962595cd85b9e3e23de0f62e899d06f447312cf22efbfece3bb6bb

Observation 6fb91da7-c493-407c-8b8f-a2eac79b91da · inbound

Goku: A Million-Scale Universal Dataset and Benchmark for Instruction-Based Video Editing cites this paper.

Goku: A Million-Scale Universal Dataset and Benchmark for Instruction-Based Video Editing OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-08-13T02:21:48.005953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-07-01T06:35:16.951243Z digest=sha256:5e2574dd873515f311b266a9e5658df712147385f3b3e1f62f1bb0fd925f1f54