{"as_of":"2026-08-15T20:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1bc59ac5ecc73a0bf1653d6220ffb234fa5fb79b918387d1cb3272428419124d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":19,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-01T06:35:16.951243Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2604.07958","last_updated":"2026-04-23T12:58:42Z","snapshot_observed_at":"2026-08-11T08:20:50.957496Z","submitted_at":"2026-04-09T08:22:09Z","title":"ImVideoEdit: Image-learning Video Editing via 2D Spatial Difference Attention Blocks","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T17:49:33.822264Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2604.07958"},"observation_digest":"sha256:f6787ee9e2edfb731f0e48476110c5bc7b73c597ccd026608d33698becf32bea","observation_id":"5b4764b9-d2bf-4e54-bbbd-843f1d49c663","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2604.08646","last_updated":"2026-04-09T17:59:02Z","snapshot_observed_at":"2026-08-12T20:44:49.937459Z","submitted_at":"2026-04-09T17:59:02Z","title":"InsEdit: Towards Instruction-based Visual Editing via Data-Efficient Video Diffusion Models Adaptation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T17:39:59.791758Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2604.08646"},"observation_digest":"sha256:8e1d6a4ead53b9116d4aa6b2439315a881b3abf90ad34abbf3ab77860bd092f2","observation_id":"fad165c7-2943-465b-bc3f-e31ed0a41bf6","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2604.16272","last_updated":"2026-04-20T15:50:04Z","snapshot_observed_at":"2026-08-14T01:26:45.409974Z","submitted_at":"2026-04-17T17:28:24Z","title":"VEFX-Bench: A Holistic Benchmark for Generic Video Editing and Visual Effects","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T08:24:41.925800Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2604.16272"},"observation_digest":"sha256:4c1e29636ab041d4273c4af00794b2f0e1b40be2775b186e40472a3bc94d1123","observation_id":"2d61b83f-1478-4500-afd6-b66de4be8234","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2604.17021","last_updated":"2026-04-18T15:09:01Z","snapshot_observed_at":"2026-08-11T09:37:14.154640Z","submitted_at":"2026-04-18T15:09:01Z","title":"LIVE: Leveraging Image Manipulation Priors for Instruction-based Video Editing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T07:21:41.483427Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2604.17021"},"observation_digest":"sha256:bf84731e0a892d59616eb249e3b45c47710b7b87a025bbd779e73f33c49e709f","observation_id":"163539ef-aa74-4de0-9825-9fedb467eb25","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2604.19193","last_updated":"2026-04-21T08:04:02Z","snapshot_observed_at":"2026-08-11T08:26:21.610628Z","submitted_at":"2026-04-21T08:04:02Z","title":"How Far Are Video Models from True Multimodal Reasoning?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T02:44:52.920816Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2604.19193"},"observation_digest":"sha256:d3f12ea5a1024d7810a5a73338230d80497cab55721286018201148d8ad66127","observation_id":"09227181-e68c-485b-b41f-72da79208551","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2605.02641","last_updated":"2026-05-04T14:26:33Z","snapshot_observed_at":"2026-08-15T05:58:46.145048Z","submitted_at":"2026-05-04T14:26:33Z","title":"Mamoda2.5: Enhancing Unified Multimodal Model with DiT-MoE","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-08T18:26:58.696936Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2605.02641"},"observation_digest":"sha256:64d7b806c2fc572c74074981ff322d24994710023ffb684de7256dc30c3f9884","observation_id":"90bc9793-19af-40b6-a9a6-bc09157d5a61","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2605.06535","last_updated":"2026-05-07T16:35:34Z","snapshot_observed_at":"2026-08-11T02:23:49.380990Z","submitted_at":"2026-05-07T16:35:34Z","title":"Sparkle: Realizing Lively Instruction-Guided Video Background Replacement via Decoupled Guidance","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T12:34:34.315135Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2605.06535"},"observation_digest":"sha256:59196f3db62d38253dabcb342dd25c4efe93d2ac6bb9ef0a64a69dc2954de682","observation_id":"89252370-c0c1-47fe-9454-4cd4f90611b4","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2605.14664","last_updated":"2026-05-26T03:55:48Z","snapshot_observed_at":"2026-08-02T00:36:02.181810Z","submitted_at":"2026-05-14T10:19:19Z","title":"MiVE: Multiscale Vision-language features for reference-guided video Editing","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-15T05:23:20.179387Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2605.14664"},"observation_digest":"sha256:93286ff1ffc3d4f708b3e571c6ac2b3f90a2ff82c9c5a1981da6ba580a21cd3c","observation_id":"31a4e36b-58de-41fd-ab58-9bddadf5c2e5","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2605.18748","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-08-15T15:10:36.944264Z","submitted_at":"2026-05-18T17:59:03Z","title":"Aurora: Unified Video Editing with a Tool-Using Agent","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T10:47:05.038308Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2605.18748"},"observation_digest":"sha256:a267267d6e15b767684a2cd7d781002a2eedeb85c45680e2c1d5dd0d4d1662ab","observation_id":"3fabf862-66be-4a5e-95ba-f7e18d49f3d4","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2605.22344","last_updated":"2026-05-21T11:30:29Z","snapshot_observed_at":"2026-08-12T12:52:42.939698Z","submitted_at":"2026-05-21T11:30:29Z","title":"Bernini: Latent Semantic Planning for Video Diffusion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-22T06:39:47.124605Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2605.22344"},"observation_digest":"sha256:e667bafb66afca1baf2e171415fb25038b98f1b3179fad5cc28767678f39ac1b","observation_id":"3454d3fc-a24e-40b7-a483-c19beff2916e","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2605.23192","last_updated":"2026-05-27T07:47:23Z","snapshot_observed_at":"2026-08-12T21:56:25.286782Z","submitted_at":"2026-05-22T03:19:24Z","title":"Occlusion-Aware Physics-Semantic Keyframe Selection for Robust Video Editing","version":1},"reference_index":113,"source":"arxiv_source","source_observed_at":"2026-05-25T05:00:31.868653Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2605.23192"},"observation_digest":"sha256:1dabc5d3da49cba9d0862885ffb96a85039e7eae6a190a6a115c6841c9acbb6c","observation_id":"ef47b832-69ec-45ab-a414-aafe309df72e","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:291b0d1d791e3656651493a078f13d37344c41b7fcc524e327eb296a31b58c82","observation_id":"fd161cf9-f099-4143-9fee-3d6793b67fa6","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2605.24674","last_updated":"2026-05-23T17:22:14Z","snapshot_observed_at":"2026-08-07T07:22:50.887133Z","submitted_at":"2026-05-23T17:22:14Z","title":"Reasoning to Align: Implicit Reasoning in Diffusion Transformers for Video Editing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T13:37:09.892339Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2605.24674"},"observation_digest":"sha256:6e36f296ba1799542acf942ec32dfaab43737d859946f3f0f8ef5517c18bbde0","observation_id":"e9949324-eddf-4d1a-b73b-e8cff83c90a0","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2605.25193","last_updated":"2026-05-29T13:55:41Z","snapshot_observed_at":"2026-08-02T06:28:29.008131Z","submitted_at":"2026-05-24T17:50:45Z","title":"SpongeBob: Sync-Aware Harmonious Audio-Visual Generative Editing","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T12:07:44.914337Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2605.25193"},"observation_digest":"sha256:8b7e9d4630e32d6bb8fac90eeea0b919653dab144a2387ac2fd91d0ec0ede95b","observation_id":"5261f483-5f19-4697-b315-9cd606b3758a","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2605.30045","last_updated":"2026-08-13T12:55:46Z","snapshot_observed_at":"2026-08-15T20:16:52.449502Z","submitted_at":"2026-05-28T14:58:36Z","title":"DualEraser: Joint Video Object and Effect Removal via Balanced Text-Mask Guidance and Decoupled Locator-Preserver","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T08:06:27.191812Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2605.30045"},"observation_digest":"sha256:7f58104a92562b2c6302d3b561597d5dd1faea6a6f057e702651af160f3a5305","observation_id":"e919bf8e-c76f-44b7-bd97-a8db6fb94c7e","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2605.30409","last_updated":"2026-05-28T17:59:17Z","snapshot_observed_at":"2026-08-14T14:36:23.951822Z","submitted_at":"2026-05-28T17:59:17Z","title":"SANA-Streaming: Real-time Streaming Video Editing with Hybrid Diffusion Transformer","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T07:39:41.553623Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2605.30409"},"observation_digest":"sha256:dfe9b964eaae3304feca2ce61c0821e1af26fd73d64982a6093c97776b9336a8","observation_id":"7e285cf4-547e-4eaa-815b-bb18befc6161","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2606.03168","last_updated":"2026-06-02T05:26:06Z","snapshot_observed_at":"2026-08-12T20:44:08.772285Z","submitted_at":"2026-06-02T05:26:06Z","title":"JAVEDIT: Joint Audio-Visual Instruction-Guided Video Editing with Agentic Data Curation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T11:04:49.366127Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2606.03168"},"observation_digest":"sha256:b688b3576375705881e6e6489db011471ab7a93c88c5e705f2b266bc31d8cc76","observation_id":"18a0ee24-8692-4f78-8519-c5aa8200a789","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2606.30599","last_updated":"2026-06-30T16:06:04Z","snapshot_observed_at":"2026-07-07T00:04:25.385438Z","submitted_at":"2026-06-29T17:38:15Z","title":"Goku: A Million-Scale Universal Dataset and Benchmark for Instruction-Based Video Editing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T06:00:24.487104Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2606.30599"},"observation_digest":"sha256:cf4df03def978ff7e3b84593807afa6691b6630ed8298c7b11a9749fcf43c259","observation_id":"257a4673-cc77-47ee-9851-28518962325e","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2606.30599","last_updated":"2026-06-30T16:06:04Z","snapshot_observed_at":"2026-07-07T00:04:25.385438Z","submitted_at":"2026-06-29T17:38:15Z","title":"Goku: A Million-Scale Universal Dataset and Benchmark for Instruction-Based Video Editing","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-01T06:35:16.951243Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2606.30599"},"observation_digest":"sha256:6541e297b6b1678b89c7e3597f5b3431534986039f8ef232b2ed50b709901eae","observation_id":"6fb91da7-c493-407c-8b8f-a2eac79b91da","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2512.07826/citation-record","integrity":"/paper/2512.07826/integrity","json":"/paper/2512.07826/citation-record.json","paper":"/paper/2512.07826"},"outbound":[],"paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T20:13:10.634592Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 19 inbound Pith citation observations for arXiv:2512.07826."}