{"as_of":"2026-08-08T21:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4221c1d49cde11bbf42bbf612130009337498ae77fc59e8127fad32af797f17a","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T14:34:02.117406Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":18,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:21:41.308248Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T07:55:30.838800Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"cited_work":{"arxiv_id":"2502.06734","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06734","snapshot_observed_at":"2026-07-01T07:55:30.838800Z","title":"A golden retrieverwearing a red harness is walking slowly with its nose close to the dry, leaf-covered ground in a fenced yard next to a bush and a road in the background","venue":null,"work_id":"253001b7-ac44-4784-9ad1-3b9b33928ca7","year":2025},"citing_paper":{"arxiv_id":"2504.17761","last_updated":"2025-07-31T05:05:45Z","snapshot_observed_at":"2026-07-06T21:14:24.007428Z","submitted_at":"2025-04-24T17:25:12Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","version":5},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-11T14:36:41.467429Z"},"links":{"cited_paper":"/paper/2502.06734","citing_paper":"/paper/2504.17761"},"observation_digest":"sha256:92b2a3f01160f771fd2db1e51fbb16bf7a17d613fcb2af366019fcf583de732f","observation_id":"6467c033-e05e-4c69-ac81-3574c016c6ed","resolution":{"observed_at":"2026-05-11T14:36:42.014639Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06734","snapshot_observed_at":"2026-08-07T12:21:41.308248Z","title":"Senorita-2m: A high-quality instruction-based dataset for general video editing by video specialists.arXiv preprint arXiv:2502.06734, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24873","last_updated":"2025-05-30T17:59:45Z","snapshot_observed_at":"2026-08-07T12:10:16.632008Z","submitted_at":"2025-05-30T17:59:45Z","title":"MiniMax-Remover: Taming Bad Noise Helps Video Object Removal","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:21:41.308248Z"},"links":{"cited_paper":"/paper/2502.06734","citing_paper":"/paper/2505.24873"},"observation_digest":"sha256:d94c3be07bc0be69837f212c755912870b45949c65c87ab402e2d33a1d0c898a","observation_id":"71e8ad13-ce70-4bc8-8281-4caf719b07be","resolution":{"observed_at":"2026-08-07T12:21:41.308248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06734","snapshot_observed_at":"2026-08-05T12:27:35.562093Z","title":"Se\\˜ norita-2m: A high-quality instruction- based dataset for general video editing by video specialists","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.01596","last_updated":"2025-09-01T16:29:39Z","snapshot_observed_at":"2026-08-08T15:15:29.549875Z","submitted_at":"2025-09-01T16:29:39Z","title":"O-DisCo-Edit: Object Distortion Control for Unified Realistic Video Editing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T12:27:35.562093Z"},"links":{"cited_paper":"/paper/2502.06734","citing_paper":"/paper/2509.01596"},"observation_digest":"sha256:176f9e84f1564ca466037d52e328c7666a814173a1fef0cb22533ab7f6cbfbc3","observation_id":"6148350f-6329-420b-b9f1-cefb4e840c79","resolution":{"observed_at":"2026-08-05T12:27:35.562093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"cited_work":{"arxiv_id":"2502.06734","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06734","snapshot_observed_at":"2026-07-01T07:55:30.838800Z","title":"A golden retrieverwearing a red harness is walking slowly with its nose close to the dry, leaf-covered ground in a fenced yard next to a bush and a road in the background","venue":null,"work_id":"253001b7-ac44-4784-9ad1-3b9b33928ca7","year":2025},"citing_paper":{"arxiv_id":"2509.20360","last_updated":"2026-04-18T01:38:10Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T17:59:30Z","title":"EditVerse: Unifying Image and Video Editing and Generation with In-Context Learning","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-18T13:46:05.547669Z"},"links":{"cited_paper":"/paper/2502.06734","citing_paper":"/paper/2509.20360"},"observation_digest":"sha256:57c1ac8cce845adaa03b41fba98f81bb5dfd8232fdfd52192706d04e24bc7aa0","observation_id":"a5dd8ca7-7353-4efb-966f-0828de6cccde","resolution":{"observed_at":"2026-05-18T13:46:25.837207Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"cited_work":{"arxiv_id":"2502.06734","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06734","snapshot_observed_at":"2026-07-01T07:55:30.838800Z","title":"A golden retrieverwearing a red harness is walking slowly with its nose close to the dry, leaf-covered ground in a fenced yard next to a bush and a road in the background","venue":null,"work_id":"253001b7-ac44-4784-9ad1-3b9b33928ca7","year":2025},"citing_paper":{"arxiv_id":"2512.07469","last_updated":"2026-04-05T12:30:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-08T11:50:18Z","title":"VideoCoF: Unified Video Editing with Temporal Reasoner","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-17T00:08:09.479706Z"},"links":{"cited_paper":"/paper/2502.06734","citing_paper":"/paper/2512.07469"},"observation_digest":"sha256:5e79b5a2b886a2193cedaf8d1e31d1c3dc4e965fc950f3bbaf885888ede69e25","observation_id":"7253c983-e39d-4c33-a4fa-3823e6bc0878","resolution":{"observed_at":"2026-05-17T00:08:43.126418Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06734","snapshot_observed_at":"2026-07-13T22:08:47.493022Z","title":"Señorita-2m: A high-quality instruction-based dataset for general video editing by video specialists.arXiv preprint arXiv:2502.06734, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.19226","last_updated":"2026-07-02T17:59:52Z","snapshot_observed_at":"2026-08-06T17:22:57.751005Z","submitted_at":"2026-03-19T17:59:45Z","title":"Under One Sun: Multi-Object Generative Perception of Materials and Illumination","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-13T22:08:47.493022Z"},"links":{"cited_paper":"/paper/2502.06734","citing_paper":"/paper/2603.19226"},"observation_digest":"sha256:d42123dff51faf74e43d7fc18298a87f48ebfb8c3049a013383b76eb48acfcbb","observation_id":"3fa7ad1d-f7b6-47ba-9276-1a48340ccc55","resolution":{"observed_at":"2026-07-13T22:08:47.493022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"cited_work":{"arxiv_id":"2502.06734","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06734","snapshot_observed_at":"2026-07-01T07:55:30.838800Z","title":"A golden retrieverwearing a red harness is walking slowly with its nose close to the dry, leaf-covered ground in a fenced yard next to a bush and a road in the background","venue":null,"work_id":"253001b7-ac44-4784-9ad1-3b9b33928ca7","year":2025},"citing_paper":{"arxiv_id":"2604.08646","last_updated":"2026-04-09T17:59:02Z","snapshot_observed_at":"2026-07-06T22:57:40.773778Z","submitted_at":"2026-04-09T17:59:02Z","title":"InsEdit: Towards Instruction-based Visual Editing via Data-Efficient Video Diffusion Models Adaptation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T17:39:59.791758Z"},"links":{"cited_paper":"/paper/2502.06734","citing_paper":"/paper/2604.08646"},"observation_digest":"sha256:03651697c56e2c7b887d6d308a7e75edd1345a33a8b30cd46b70be61255ee0f4","observation_id":"4f6801e6-67af-49a5-a181-e1107e417339","resolution":{"observed_at":"2026-05-11T06:25:57.579183Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"cited_work":{"arxiv_id":"2502.06734","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06734","snapshot_observed_at":"2026-07-01T07:55:30.838800Z","title":"A golden retrieverwearing a red harness is walking slowly with its nose close to the dry, leaf-covered ground in a fenced yard next to a bush and a road in the background","venue":null,"work_id":"253001b7-ac44-4784-9ad1-3b9b33928ca7","year":2025},"citing_paper":{"arxiv_id":"2605.01638","last_updated":"2026-05-02T22:56:17Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T22:56:17Z","title":"Omni-Fake: Benchmarking Unified Multimodal Social Media Deepfake Detection","version":1},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-05-09T14:04:52.065878Z"},"links":{"cited_paper":"/paper/2502.06734","citing_paper":"/paper/2605.01638"},"observation_digest":"sha256:5253fb7c526f8e33975dbab27a5430bf392709255f5f647a1d1dfd4adb4acc56","observation_id":"e47282b7-5dac-4410-8ec7-7ffa7add2e6a","resolution":{"observed_at":"2026-05-11T17:06:04.285073Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"cited_work":{"arxiv_id":"2502.06734","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06734","snapshot_observed_at":"2026-07-01T07:55:30.838800Z","title":"A golden retrieverwearing a red harness is walking slowly with its nose close to the dry, leaf-covered ground in a fenced yard next to a bush and a road in the background","venue":null,"work_id":"253001b7-ac44-4784-9ad1-3b9b33928ca7","year":2025},"citing_paper":{"arxiv_id":"2605.04569","last_updated":"2026-05-28T14:50:27Z","snapshot_observed_at":"2026-07-06T23:17:18.486586Z","submitted_at":"2026-05-06T07:15:29Z","title":"LIVEditor-14B: Lightning Unified Video Editing via In-Context Sparse Attention","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-07-01T00:24:30.573122Z"},"links":{"cited_paper":"/paper/2502.06734","citing_paper":"/paper/2605.04569"},"observation_digest":"sha256:9e9ce652b9deda13aaa344ddd412b5c5d93ebf4fc84e811e1c7c55a50e57cb02","observation_id":"424be639-87c3-4e15-9fcd-e89a3e71a1be","resolution":{"observed_at":"2026-07-01T00:25:09.361619Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"cited_work":{"arxiv_id":"2502.06734","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06734","snapshot_observed_at":"2026-07-01T07:55:30.838800Z","title":"A golden retrieverwearing a red harness is walking slowly with its nose close to the dry, leaf-covered ground in a fenced yard next to a bush and a road in the background","venue":null,"work_id":"253001b7-ac44-4784-9ad1-3b9b33928ca7","year":2025},"citing_paper":{"arxiv_id":"2605.06535","last_updated":"2026-05-07T16:35:34Z","snapshot_observed_at":"2026-07-06T23:19:00.794334Z","submitted_at":"2026-05-07T16:35:34Z","title":"Sparkle: Realizing Lively Instruction-Guided Video Background Replacement via Decoupled Guidance","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-08T12:34:34.315135Z"},"links":{"cited_paper":"/paper/2502.06734","citing_paper":"/paper/2605.06535"},"observation_digest":"sha256:83e954de1aa47e9b6b0ed055d3b788e959b1f8e47efd0958ca34169199311171","observation_id":"afcd0946-6219-4eef-ad83-30a35095024f","resolution":{"observed_at":"2026-05-11T19:06:11.969943Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"cited_work":{"arxiv_id":"2502.06734","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06734","snapshot_observed_at":"2026-07-01T07:55:30.838800Z","title":"A golden retrieverwearing a red harness is walking slowly with its nose close to the dry, leaf-covered ground in a fenced yard next to a bush and a road in the background","venue":null,"work_id":"253001b7-ac44-4784-9ad1-3b9b33928ca7","year":2025},"citing_paper":{"arxiv_id":"2605.18467","last_updated":"2026-05-18T14:27:05Z","snapshot_observed_at":"2026-07-06T23:29:20.279470Z","submitted_at":"2026-05-18T14:27:05Z","title":"InstructAV2AV: Instruction-Guided Audio-Video Joint Editing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-20T11:34:32.558440Z"},"links":{"cited_paper":"/paper/2502.06734","citing_paper":"/paper/2605.18467"},"observation_digest":"sha256:c151ca46960b5155b8ab62f97e872bbadffeede53d3be8c5681c7557b4ac2feb","observation_id":"4e5b4a75-01ad-40b5-aa12-3a8d9528dd7e","resolution":{"observed_at":"2026-05-20T11:38:14.723253Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"cited_work":{"arxiv_id":"2502.06734","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06734","snapshot_observed_at":"2026-07-01T07:55:30.838800Z","title":"A golden retrieverwearing a red harness is walking slowly with its nose close to the dry, leaf-covered ground in a fenced yard next to a bush and a road in the background","venue":null,"work_id":"253001b7-ac44-4784-9ad1-3b9b33928ca7","year":2025},"citing_paper":{"arxiv_id":"2605.18748","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-08-02T06:15:05.492636Z","submitted_at":"2026-05-18T17:59:03Z","title":"Aurora: Unified Video Editing with a Tool-Using Agent","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-20T10:47:05.038308Z"},"links":{"cited_paper":"/paper/2502.06734","citing_paper":"/paper/2605.18748"},"observation_digest":"sha256:0c167a1b223b0662882b907ef95d6034720c0f9890864269956032dc63881df0","observation_id":"e92d4077-2ccc-4a26-bdcf-63d68177fe92","resolution":{"observed_at":"2026-05-20T10:48:12.726167Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"cited_work":{"arxiv_id":"2502.06734","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06734","snapshot_observed_at":"2026-07-01T07:55:30.838800Z","title":"A golden retrieverwearing a red harness is walking slowly with its nose close to the dry, leaf-covered ground in a fenced yard next to a bush and a road in the background","venue":null,"work_id":"253001b7-ac44-4784-9ad1-3b9b33928ca7","year":2025},"citing_paper":{"arxiv_id":"2605.21466","last_updated":"2026-06-30T17:59:52Z","snapshot_observed_at":"2026-08-02T01:16:29.352385Z","submitted_at":"2026-05-20T17:52:10Z","title":"StreamEdit: Training-Free Video Editing via Few-Step Streaming Video Generation","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-21T04:53:55.386923Z"},"links":{"cited_paper":"/paper/2502.06734","citing_paper":"/paper/2605.21466"},"observation_digest":"sha256:9e66645367d9fe00630d7f0621685e2a03c21a0dd78ec6551fef944720e3be69","observation_id":"b513661f-8be0-4224-aa5e-04e27f7f2e72","resolution":{"observed_at":"2026-05-21T04:53:57.681809Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"cited_work":{"arxiv_id":"2502.06734","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06734","snapshot_observed_at":"2026-07-01T07:55:30.838800Z","title":"A golden retrieverwearing a red harness is walking slowly with its nose close to the dry, leaf-covered ground in a fenced yard next to a bush and a road in the background","venue":null,"work_id":"253001b7-ac44-4784-9ad1-3b9b33928ca7","year":2025},"citing_paper":{"arxiv_id":"2605.21466","last_updated":"2026-06-30T17:59:52Z","snapshot_observed_at":"2026-08-02T01:16:29.352385Z","submitted_at":"2026-05-20T17:52:10Z","title":"StreamEdit: Training-Free Video Editing via Few-Step Streaming Video Generation","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-07-01T07:49:06.391436Z"},"links":{"cited_paper":"/paper/2502.06734","citing_paper":"/paper/2605.21466"},"observation_digest":"sha256:1e82bed47b8cdde5579e3b4df30ef0023da73ac14ae84caf886b2bf2f380a1ee","observation_id":"c6ab60b4-a4a9-4d6d-afcc-873b1cfe21a1","resolution":{"observed_at":"2026-07-01T07:55:30.840943Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"cited_work":{"arxiv_id":"2502.06734","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06734","snapshot_observed_at":"2026-07-01T07:55:30.838800Z","title":"A golden retrieverwearing a red harness is walking slowly with its nose close to the dry, leaf-covered ground in a fenced yard next to a bush and a road in the background","venue":null,"work_id":"253001b7-ac44-4784-9ad1-3b9b33928ca7","year":2025},"citing_paper":{"arxiv_id":"2605.24674","last_updated":"2026-05-23T17:22:14Z","snapshot_observed_at":"2026-08-07T07:22:50.887133Z","submitted_at":"2026-05-23T17:22:14Z","title":"Reasoning to Align: Implicit Reasoning in Diffusion Transformers for Video Editing","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-30T13:37:09.892339Z"},"links":{"cited_paper":"/paper/2502.06734","citing_paper":"/paper/2605.24674"},"observation_digest":"sha256:5775cccc24a442b01f2b4c83bbb9db8c47e0adb22535d77db1eec6c2bccb26d3","observation_id":"d23f9d27-f0fb-40c4-b004-66f6d2470acb","resolution":{"observed_at":"2026-06-30T13:44:41.145007Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"cited_work":{"arxiv_id":"2502.06734","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06734","snapshot_observed_at":"2026-07-01T07:55:30.838800Z","title":"A golden retrieverwearing a red harness is walking slowly with its nose close to the dry, leaf-covered ground in a fenced yard next to a bush and a road in the background","venue":null,"work_id":"253001b7-ac44-4784-9ad1-3b9b33928ca7","year":2025},"citing_paper":{"arxiv_id":"2605.25193","last_updated":"2026-05-29T13:55:41Z","snapshot_observed_at":"2026-08-02T06:28:29.008131Z","submitted_at":"2026-05-24T17:50:45Z","title":"SpongeBob: Sync-Aware Harmonious Audio-Visual Generative Editing","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T12:07:44.914337Z"},"links":{"cited_paper":"/paper/2502.06734","citing_paper":"/paper/2605.25193"},"observation_digest":"sha256:69e9249f0d7ef812a940b0d515c536a5d66b52a89f947aa2d5fb6049282dd3e9","observation_id":"d61e88f4-3fe8-450f-bc2e-7d6c2322071a","resolution":{"observed_at":"2026-06-30T12:34:39.557244Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06734","snapshot_observed_at":"2026-08-01T07:15:33.659124Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21529","last_updated":"2026-07-31T09:23:37Z","snapshot_observed_at":"2026-08-08T03:21:15.162809Z","submitted_at":"2026-07-23T17:15:30Z","title":"ElasticTTT: Prior-Preserving Test-Time Tuning for Video Editing","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-01T07:15:33.659124Z"},"links":{"cited_paper":"/paper/2502.06734","citing_paper":"/paper/2607.21529"},"observation_digest":"sha256:3de66786faa80fc26d91616181d5d1ddb9787840f49686e3983dc9db0b76c479","observation_id":"47fa062d-9b6a-43d9-8126-df62952a8cfc","resolution":{"observed_at":"2026-08-01T07:15:33.659124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06734","snapshot_observed_at":"2026-08-03T01:56:59.724051Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21529","last_updated":"2026-07-31T09:23:37Z","snapshot_observed_at":"2026-08-08T03:21:15.162809Z","submitted_at":"2026-07-23T17:15:30Z","title":"ElasticTTT: Prior-Preserving Test-Time Tuning for Video Editing","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-03T01:56:59.724051Z"},"links":{"cited_paper":"/paper/2502.06734","citing_paper":"/paper/2607.21529"},"observation_digest":"sha256:ae24ff32892cdf7ba69746eaa0bac2d20dc8744b7a234968bc832391e06cee2a","observation_id":"361c599b-b00a-4c0b-8e2f-6eb2e1900059","resolution":{"observed_at":"2026-08-03T01:56:59.724051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.06734/citation-record","integrity":"/paper/2502.06734/integrity","json":"/paper/2502.06734/citation-record.json","paper":"/paper/2502.06734"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-08T14:34:01.998242Z","title":"H., Chechik, G., and Cohen-Or, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:01.998242Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:b1654d9154f589e3e2a4c8dc03cc592354c17cf53908ea7c1d84acb5b001a81f","observation_id":"3968fcc7-b0b5-41bb-b816-ec748c4a6f34","resolution":{"observed_at":"2026-08-08T14:34:01.998242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10373","last_updated":"2023-11-20T10:54:09Z","snapshot_observed_at":"2026-08-06T08:12:35.134201Z","submitted_at":"2023-07-19T18:00:03Z","title":"TokenFlow: Consistent Diffusion Features for Consistent Video Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10373","snapshot_observed_at":"2026-08-08T14:34:02.002068Z","title":"Tokenflow: Consistent diffusion features for consistent video editing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.002068Z"},"links":{"cited_paper":"/paper/2307.10373","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:aa6480f78be5ce9f045dd5cad2250cc3b15262ab1cb0b6df169b32c7688df269","observation_id":"3e8f7153-f15e-4aa8-a82d-36d60faf3cd5","resolution":{"observed_at":"2026-08-08T14:34:02.002068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-08T14:34:02.005885Z","title":"Sparsectrl: Adding sparse controls to text-to-video diffusion models, 2023a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.005885Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:2b3bcd014d60cf03cc56bac08be90e2bfd08bfcd27610b6cb44bc04b36883ddc","observation_id":"a9ed8e8d-e873-464c-8a7c-0fb7e7e326fe","resolution":{"observed_at":"2026-08-08T14:34:02.005885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:34:02.583072Z","title":"commas and used as input prompts for Grounded-SAM2 (Liu et al., 2023a; Ravi et al., 2024)","venue":null,"work_id":"3f753453-3318-473b-a5fa-dc91e7425cd7","year":2024},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.082556Z"},"links":{"citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:ab5c8d72088eaa87e00e978be1d41038173d609965f2f7740a56f67a24d93b10","observation_id":"ddf45ffd-7775-4269-a74d-f6ceaeacb56e","resolution":{"observed_at":"2026-08-08T14:34:02.586471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15260","last_updated":"2025-07-14T07:52:04Z","snapshot_observed_at":"2026-08-02T18:28:16.134163Z","submitted_at":"2024-11-22T10:04:05Z","title":"VIVID-10M: A Dataset and Baseline for Versatile and Interactive Video Local Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15260","snapshot_observed_at":"2026-08-08T14:34:02.014040Z","title":"Vivid-10m: A dataset and baseline for versatile and interactive video local editing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.014040Z"},"links":{"cited_paper":"/paper/2411.15260","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:f028e5708ef5c9afa28cff11d172357d4b1a14fa56bf3059fd94bf214398b7f7","observation_id":"56ceb27b-0a23-4396-b94a-19cb1c46bd9f","resolution":{"observed_at":"2026-08-08T14:34:02.014040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-08-08T14:34:02.017686Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing.arXiv preprint arXiv:2404.09990,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.017686Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:c6f19118401530c8c6774060c22347abf0aa2a4363e57a696a0754df24f953a6","observation_id":"dc93fe88-f379-40c1-834c-e3698e829b37","resolution":{"observed_at":"2026-08-08T14:34:02.017686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11402","last_updated":"2024-12-14T00:49:52Z","snapshot_observed_at":"2026-08-06T07:33:31.450060Z","submitted_at":"2024-08-21T08:01:00Z","title":"Video Diffusion Models are Strong Video Inpainter","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11402","snapshot_observed_at":"2026-08-08T14:34:02.025207Z","title":"Video diffusion models are strong video inpainter","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.025207Z"},"links":{"cited_paper":"/paper/2408.11402","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:d817c06c25abf48063b6fc6f9d525458d19c974de9c956758cf79af8ba0bea7b","observation_id":"8e5ceaf7-b428-4401-8fea-8974b1755fe7","resolution":{"observed_at":"2026-08-08T14:34:02.025207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:34:02.029073Z","title":"Stablev2v: Stablizing shape consistency in video-to-video editing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.029073Z"},"links":{"citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:9e09b3861df7990a95ad87c2b2695e45676ddcc81c1481f4372b3b4c94879e7e","observation_id":"a110379d-fa15-4e05-bd0f-be30a42b816b","resolution":{"observed_at":"2026-08-08T14:34:02.029073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:34:02.532627Z","title":"The video on the left depicts the original video, while the video on the right displays the edited videos","venue":null,"work_id":"a67bf5d0-d7c1-4a03-ab83-62fbcde5abe0","year":2017},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.100540Z"},"links":{"citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:4c2b0b7ab22bf27ea18a00a20c40303e78ce84839ae893bf8b82feabbb066fc6","observation_id":"65508319-28ab-45a2-9db6-7b693d1e3e26","resolution":{"observed_at":"2026-08-08T14:34:02.536489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-08-08T06:35:17.078531Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-08T14:34:02.036011Z","title":"Sdedit: Guided image synthesis and edit- ing with stochastic differential equations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.036011Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:57cd52e18745efd7c932fd0cfbf7f61d9464b56168bd034e26df69f7d364ca2c","observation_id":"2943a5e1-0cbd-4409-a54b-0ca3edd5d155","resolution":{"observed_at":"2026-08-08T14:34:02.036011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13865","last_updated":"2024-05-22T17:46:08Z","snapshot_observed_at":"2026-07-06T18:18:07.839497Z","submitted_at":"2024-05-22T17:46:08Z","title":"ReVideo: Remake a Video with Motion and Content Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13865","snapshot_observed_at":"2026-08-08T14:34:02.039641Z","title":"Revideo: Remake a video with motion and content control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.039641Z"},"links":{"cited_paper":"/paper/2405.13865","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:b165f0f3757068df86e92b6c7c7b13156c83692a2400cb0883378fb3da1969d7","observation_id":"872c7789-ff4e-46c1-b721-5248140c7282","resolution":{"observed_at":"2026-08-08T14:34:02.039641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:34:02.601723Z","title":"Zero-shot image-to-image translation","venue":null,"work_id":"279e6cee-ee58-47c2-ac44-1644d4e1f232","year":2023},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.043064Z"},"links":{"citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:dfc529aea65f302cca44771ea3c9d723b63e60d68ca4cec37c002f59e82c6c23","observation_id":"be7ebc54-aa6f-48b9-b111-c69517bea17c","resolution":{"observed_at":"2026-08-08T14:34:02.604917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.00675","last_updated":"2018-03-01T17:50:08Z","snapshot_observed_at":"2026-08-02T10:51:13.194643Z","submitted_at":"2017-04-03T16:44:46Z","title":"The 2017 DAVIS Challenge on Video Object Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.00675","snapshot_observed_at":"2026-08-08T14:34:02.046546Z","title":"The 2017 davis chal- lenge on video object segmentation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.046546Z"},"links":{"cited_paper":"/paper/1704.00675","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:fd07a97187c11c6f8bc22040304b27202e35a3b8534135ff9a647827fa72158b","observation_id":"c20652ba-8f08-4c35-964a-287171ab34c9","resolution":{"observed_at":"2026-08-08T14:34:02.046546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14988","last_updated":"2022-09-29T17:50:40Z","snapshot_observed_at":"2026-07-06T13:57:54.539656Z","submitted_at":"2022-09-29T17:50:40Z","title":"DreamFusion: Text-to-3D using 2D Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14988","snapshot_observed_at":"2026-08-08T14:34:02.050432Z","title":"T., and Mildenhall, B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.050432Z"},"links":{"cited_paper":"/paper/2209.14988","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:1f26f53294775e93438ab0402a068f829867f74d2ad67ece99368c229941127e","observation_id":"0c8114e1-09fb-4ad0-8faf-59d53d2c1a9c","resolution":{"observed_at":"2026-08-08T14:34:02.050432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09535","last_updated":"2023-10-11T17:46:21Z","snapshot_observed_at":"2026-07-06T15:04:23.117620Z","submitted_at":"2023-03-16T17:51:13Z","title":"FateZero: Fusing Attentions for Zero-shot Text-based Video Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09535","snapshot_observed_at":"2026-08-08T14:34:02.054247Z","title":"Fatezero: Fusing attentions for zero-shot text- based video editing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.054247Z"},"links":{"cited_paper":"/paper/2303.09535","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:7ff09e315c7cba738041a4f3b6883d6451059c7bf4420593dc783d6f4fb7fa1b","observation_id":"bb7bec9a-b80e-4707-93b8-610c8f73af7e","resolution":{"observed_at":"2026-08-08T14:34:02.054247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-08T14:34:02.065194Z","title":"Ronneberger, O., Fischer, P., and Brox, T","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.065194Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:76113f34671270a3544376e7a16e107152ab29814b8403afa73881e052ab2994","observation_id":"3fc7e47a-e520-4b09-be19-aa1676ca7d34","resolution":{"observed_at":"2026-08-08T14:34:02.065194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:34:02.592543Z","title":"Plug- and-play diffusion features for text-driven image-to-image translation","venue":null,"work_id":"0025123a-f0c7-41b2-aea8-dde82db7b428","year":1921},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.068745Z"},"links":{"citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:2059d92899adcb61bb6a08f4c05c3bd8c0b9908f442ab4b8716f355ed2dc64d3","observation_id":"157abfa0-e1ee-43ce-992a-c0f3a5034dc2","resolution":{"observed_at":"2026-08-08T14:34:02.595960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07199","last_updated":"2025-04-28T14:16:29Z","snapshot_observed_at":"2026-07-06T19:48:36.508447Z","submitted_at":"2024-11-11T18:21:43Z","title":"OmniEdit: Building Image Editing Generalist Models Through Specialist Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07199","snapshot_observed_at":"2026-08-08T14:34:02.072438Z","title":"Omniedit: Building image editing general- ist models through specialist supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.072438Z"},"links":{"cited_paper":"/paper/2411.07199","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:4912828695120262b0090aa82e8e893ff8f684077f0703adeb6aeeb3b1de5265","observation_id":"77b33201-cf32-4aad-a065-9ea7f40b1021","resolution":{"observed_at":"2026-08-08T14:34:02.072438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:34:02.076020Z","title":"Zhang, K., Mo, L., Chen, W., Sun, H., and Su, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.076020Z"},"links":{"citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:6ecaabe698dad9ef06888b6b8b97d95f10c90f7ed980323485352be65b5b4ba0","observation_id":"6d671e7a-02ea-40a6-bbd1-da6aacf34d06","resolution":{"observed_at":"2026-08-08T14:34:02.076020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12035","last_updated":"2024-03-18T17:59:27Z","snapshot_observed_at":"2026-08-05T17:13:30.746659Z","submitted_at":"2024-03-18T17:59:27Z","title":"CoCoCo: Improving Text-Guided Video Inpainting for Better Consistency, Controllability and Compatibility","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12035","snapshot_observed_at":"2026-08-08T14:34:02.079224Z","title":"Cococo: Improving text- guided video inpainting for better consistency, controlla- bility and compatibility.arXiv preprint arXiv:2403.12035,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.079224Z"},"links":{"cited_paper":"/paper/2403.12035","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:8b35bb6c9e106af246aa6231868287f820843cecfe8830ac04f97c1fcdeb27aa","observation_id":"dc54726e-b55e-448e-a843-fcd2e0f400be","resolution":{"observed_at":"2026-08-08T14:34:02.079224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:34:02.573316Z","title":"This limitation prevents us from applying techniques such as ControlNet to repaint a video effectively","venue":null,"work_id":"ea029421-9f58-4be0-92d6-f747c12c6d20","year":2025},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.086274Z"},"links":{"citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:1dc686d793db419a178b1c34614c43058bd3502933457f26e9740eedd38b734b","observation_id":"c28dd6a3-e0f2-4b05-ba95-b98c0f9cde40","resolution":{"observed_at":"2026-08-08T14:34:02.576857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:34:02.563383Z","title":"Table 5 shows that our expert model outperforms all baselines, achieving the lowest Ewarp (9.02), highest CLIPScore (0.3145), and best Temporal Consistency (0.9781)","venue":null,"work_id":"0475eb9b-c8ca-4c56-8925-c29ed2067858","year":2024},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.089985Z"},"links":{"citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:c43f9a682a6a98cbe5add0eb44ad89c2d4eb0aa40349cf4cd09124d549e0f34a","observation_id":"19183171-3c17-41da-8f31-ae79636fa012","resolution":{"observed_at":"2026-08-08T14:34:02.567351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:34:02.553735Z","title":"The best results are boldfaced","venue":null,"work_id":"50637eee-4f32-4a1c-91fd-f5a87f71e8cc","year":2017},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.093464Z"},"links":{"citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:f17c911b8065115484bf1f8154897bedbb10afa11bdee5753a31687b335a1a3f","observation_id":"5d8ed50c-0bc1-46d7-be75-99d457685518","resolution":{"observed_at":"2026-08-08T14:34:02.556959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:34:02.544027Z","title":"Bottom: The data construction pipeline for Señorita-2M using our inpainter","venue":null,"work_id":"6d7b9746-7c59-4ae5-a92c-91cdde9096f8","year":2024},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.097023Z"},"links":{"citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:10caa8e10c39ba4161da6c6eb8004bfee03e05e5a16bdfb66a1ad5936361caa2","observation_id":"310b5d8b-27a2-45d2-8c50-e7828f4592c1","resolution":{"observed_at":"2026-08-08T14:34:02.547526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:34:02.522437Z","title":null,"venue":null,"work_id":"9ebfbf4d-4ba7-41e1-bfba-752c9b764402","year":2023},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.103896Z"},"links":{"citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:f1419e2ce5129590ab981ac8b2dcf27001f0f50b804b171a77937fee71bd1f80","observation_id":"19ae2d9c-29ad-4530-a975-96bab3585997","resolution":{"observed_at":"2026-08-08T14:34:02.525890Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:34:02.512167Z","title":"For object recognition, we utilize CogVLM-video-llama3-chat (Hong et al.,","venue":null,"work_id":"846be775-ceaf-400c-98cd-2ef9b76daa12","year":2021},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.107185Z"},"links":{"citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:fc5c0154dfbf10f20547a50f40828b9f649c595bb1c1c80a17ea5ecc5d54c8f2","observation_id":"4a10c795-5672-4f74-8382-50f9dcd94ef0","resolution":{"observed_at":"2026-08-08T14:34:02.515628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:34:02.501427Z","title":"We set the maximum token length to 120 and use six frames per video","venue":null,"work_id":"e9450094-b01d-4154-ac13-1f0f7126b957","year":2024},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.110454Z"},"links":{"citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:2489e39024f79d52f2af83305334be272a0e1b669803d726b1236fd03b8e4f08","observation_id":"29e4c9da-64d4-4c24-b5ea-61148795e91a","resolution":{"observed_at":"2026-08-08T14:34:02.505628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:34:02.491540Z","title":"Detect\" or","venue":null,"work_id":"6b0a4184-7668-4576-87e4-f6b5b058fe22","year":1984},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.114011Z"},"links":{"citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:b3d704ac3ce637539b6ac1e38e8257465a52918f80f813fdd9b264580a36ade3","observation_id":"f552e8c8-f3b5-4e00-a369-3fd06334b793","resolution":{"observed_at":"2026-08-08T14:34:02.495005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:34:02.479770Z","title":"There be","venue":null,"work_id":"90a74a91-9bfe-4091-ad38-4691df6f844f","year":1984},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":592,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.117406Z"},"links":{"citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:173b9813f47a1ff57db839f6849e71c1ea4d6d4b982b5e1b14ce8565bd33901d","observation_id":"e6efe788-38df-4990-8af4-7998ff0f43bf","resolution":{"observed_at":"2026-08-08T14:34:02.484560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01095","last_updated":"2025-05-19T07:56:56Z","snapshot_observed_at":"2026-07-29T20:17:21.488997Z","submitted_at":"2022-11-02T13:14:30Z","title":"DPM-Solver++: Fast Solver for Guided Sampling of Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01095","snapshot_observed_at":"2026-08-08T14:34:02.032389Z","title":"Dpm- solver++: Fast solver for guided sampling of diffusion probabilistic models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.032389Z"},"links":{"cited_paper":"/paper/2211.01095","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:c6226d1df97e93df0ef38d6a31d4158068122e2784952ec2d5c2537c5de0cd52","observation_id":"e9b5e5a9-be66-4812-ba75-4cafddfc9199","resolution":{"observed_at":"2026-08-08T14:34:02.032389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-08T14:34:02.058260Z","title":"Hierarchical text-conditional image generation with clip latents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.058260Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:50919352cd529429cffc5a7f58a6d6b7704a0367cbcada0685ca294469af3bfb","observation_id":"8a8d4ad2-12ee-4734-8eb7-2b0ed1cf73de","resolution":{"observed_at":"2026-08-08T14:34:02.058260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16500","last_updated":"2024-08-29T12:59:12Z","snapshot_observed_at":"2026-08-05T11:54:14.447608Z","submitted_at":"2024-08-29T12:59:12Z","title":"CogVLM2: Visual Language Models for Image and Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16500","snapshot_observed_at":"2026-08-08T14:34:02.009863Z","title":"Cogvlm2: Vi- sual language models for image and video understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.009863Z"},"links":{"cited_paper":"/paper/2408.16500","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:c496e5a22bc443d94d38e605bd0db302fd4ea9904ebea5d80edb050b5cfeb4a3","observation_id":"ccf3b396-b07e-4a72-b983-5689db8bcda2","resolution":{"observed_at":"2026-08-08T14:34:02.009863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09047","last_updated":"2024-01-17T08:30:32Z","snapshot_observed_at":"2026-08-04T07:40:19.403363Z","submitted_at":"2024-01-17T08:30:32Z","title":"VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09047","snapshot_observed_at":"2026-08-08T14:34:01.989009Z","title":"Videocrafter2: Overcoming data limitations for high-quality video diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:01.989009Z"},"links":{"cited_paper":"/paper/2401.09047","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:b21faf6f11b4eb38bd755a3bc71cc1d68a10fcceb2605efc111ba188e8b60f93","observation_id":"cda3b44a-09aa-412d-9c2f-51313623c117","resolution":{"observed_at":"2026-08-08T14:34:01.989009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T14:34:01.993732Z","title":"Dubey, A., Jauhri, A., Pandey, A., Kadian, A., Al-Dahle, A., Letman, A., Mathur, A., Schelten, A., Yang, A., Fan, A., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:01.993732Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:045e6624b66948ea5c52207854079f5aec4178514f4d698e3b0ff3ba6d33e7bf","observation_id":"4dbe9b51-1bda-4641-b1c8-78a8ddde0fed","resolution":{"observed_at":"2026-08-08T14:34:01.993732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-08T14:34:02.021500Z","title":"Ku, M., Wei, C., Ren, W., Yang, H., and Chen, W","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.021500Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:f1d3d8a27184347b82d26ff9d642c864fcb73b9b1b7319dd564cd4fbcf9627a9","observation_id":"430243a2-6521-4863-93bf-61ca84c74603","resolution":{"observed_at":"2026-08-08T14:34:02.021500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 18 inbound Pith citation observations for arXiv:2502.06734."}