{"as_of":"2026-08-15T11:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bfe5f88a08f7dc15903af192aa1bc35d2b35c651041aa5241ee1865c8869782d","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-25T04:30:20.593882Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T01:18:51.054590Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.23891","snapshot_observed_at":"2026-07-12T01:18:51.054590Z","title":"arXiv preprint arXiv:2605.23891 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03595","last_updated":"2026-07-03T20:34:42Z","snapshot_observed_at":"2026-08-12T22:30:04.734869Z","submitted_at":"2026-07-03T20:34:42Z","title":"Token-Based Affordance Grounding with Large Vision-Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-12T01:18:51.054590Z"},"links":{"cited_paper":"/paper/2605.23891","citing_paper":"/paper/2607.03595"},"observation_digest":"sha256:320a442bca539eb00e7bbeec8306d3651810a82c38f06bb4e85e9eca04e0a7d9","observation_id":"693454b5-0237-478f-836c-a642a0cfcafb","resolution":{"observed_at":"2026-07-12T01:18:51.054590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.23891/citation-record","integrity":"/paper/2605.23891/integrity","json":"/paper/2605.23891/citation-record.json","paper":"/paper/2605.23891"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denoising diffusion proba- bilistic models","venue":null,"work_id":"7f81a9f6-7c8e-4168-a309-d39a3dcc0ea8","year":2020},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:6befa4e0ce6f3ab0ec5bec2b82a7e1fdc4f02f574cef91113f8103ffece9ebaa","observation_id":"ebfb3cf8-87be-40c9-9ed6-53d734b1552b","resolution":{"observed_at":"2026-05-25T13:30:53.994822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalable diffusion models with trans- formers","venue":null,"work_id":"2f44493f-4852-4dd7-94cd-9a16a024ca10","year":2023},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:a618ff300803b3ae68ac349491e027c03d0c4820f49c681ce67d456483f68cb7","observation_id":"3a096e2a-b362-4065-8a79-a946419accdf","resolution":{"observed_at":"2026-05-25T13:30:54.008191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual autoregressive modeling: Scalable image generation via next- scale prediction","venue":null,"work_id":"0a1c3fb8-bd97-4e32-8785-cbeb5c490cba","year":2024},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:5af8d200b25861a4f58ca2dcc0e61e454aac70295ef013b1e0ac89f380dbc8b9","observation_id":"6353b522-f826-44d6-8481-1076223b41ed","resolution":{"observed_at":"2026-05-25T13:30:53.991022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on video diffusion models","venue":null,"work_id":"35f626ac-83f5-40df-b25f-deeeab261240","year":2024},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:21e51d4de3d069771a06e474425c6a3ee7c044b2fa86070ee68a5c89a2df933f","observation_id":"34b6c747-2ccb-42b9-8ab0-120463c95e79","resolution":{"observed_at":"2026-05-25T13:30:54.000049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Omnigen: Unified image generation","venue":null,"work_id":"cc38c75b-b648-4f7b-86c7-6075f2a200f8","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:e3684adcc4e1c9ce9e7e13b76dc5d7101a1a2922664f046370bec95eecf27bb0","observation_id":"4589c1bb-0874-400d-b90c-d9ba4d273269","resolution":{"observed_at":"2026-05-25T13:30:53.968647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":"2412.20404","doi":"10.48550/arxiv.2412.20404","metadata_source":"pith","pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open-Sora: Democratizing Efficient Video Production for All","venue":"cs.CV","work_id":"8b29ba7b-3d84-4281-85b7-9eaf905afd7f","year":2024},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:e969f6f56b014f37d6d2e691da3f074326bb4a3e31ef7835a226b57cdc22c55f","observation_id":"4c29aae5-5edd-4cf9-a800-c91ed76145a5","resolution":{"observed_at":"2026-05-25T04:35:21.963369Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":"2408.12528","doi":"10.48550/arxiv.2408.12528","metadata_source":"pith","pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","venue":"cs.CV","work_id":"1393dc24-a6b2-44e1-b5d7-7009d1fa4811","year":2024},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:9d63724c68a42a60a55137fd4d8882cc08e1e397e30201a9a985c225129b55db","observation_id":"6d2b7383-01f6-4543-83f2-a0db1828593d","resolution":{"observed_at":"2026-05-25T04:35:21.959481Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":"2501.00103","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-07-09T07:56:04.699528Z","title":"LTX-Video: Realtime Video Latent Diffusion","venue":"cs.CV","work_id":"cee5c521-3ce9-466e-a035-1e42f89254f4","year":2024},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:07febf9c4dddc663ab20a0fdcbb85488d64caa3ffadb904f406f86563bd02ed3","observation_id":"a2a30f7e-6a7c-4176-b983-fc77492c48be","resolution":{"observed_at":"2026-05-25T04:35:21.967731Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dragvideo: Interactive drag-style video editing","venue":null,"work_id":"f14a67ab-6203-42ec-958f-017e6aa0b660","year":2024},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:a10a27ba702f4c7cf0f2d9738cb8a1f30679329f3aea3de39ba25bf79dc7064a","observation_id":"481bb6d3-2f17-4dfe-bcb0-90ac4652ab16","resolution":{"observed_at":"2026-05-25T13:30:53.975636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Direct-a-video: Customized video generation with user-directed camera movement and object motion","venue":null,"work_id":"fd452295-74e6-43f2-ad74-3c6493313383","year":2024},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:4326c3c68d1c8ff2af73163cc8cb8b5ea6151398233c28a174de8d5002b96ccf","observation_id":"3b6d7119-9113-48bd-8e79-718246b289a9","resolution":{"observed_at":"2026-05-25T13:30:53.983707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Keyframe-guided creative video inpainting","venue":null,"work_id":"b7702a7a-7f17-4ce4-9561-9e1177dff5b7","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:d858b7329656e8e435f1d2897e46ce3b6fb7e39dc9e55670814310d4e92cf1bc","observation_id":"9cf6a045-40fb-44df-a1a4-2d45f45b89fe","resolution":{"observed_at":"2026-05-25T13:30:53.979507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shape-for- motion: Precise and consistent video editing with 3d proxy","venue":null,"work_id":"f454c20e-1f52-4c6a-a4b4-57991c82c96d","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:1a5381ebdbcbf0a7d312dbb918937b2326ad8a0a1ee87ac539cdc9e9268c2057","observation_id":"df4578d0-7c9d-42b5-9069-7264c9ce97f8","resolution":{"observed_at":"2026-05-25T13:30:53.987522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.10082","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T21:16:14.728944Z","title":"Lora-edit: Controllable first-frame-guided video editing via mask-aware lora fine-tuning","venue":null,"work_id":"065c0f0a-b60c-4ce2-947f-186193bc14cf","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:42f08e712ea461b21f8ee18ba5e15f39b794aa2927868bac1f2d1761cc0f0ef3","observation_id":"a45dbec6-9dc8-4418-bb2a-6a4723436eb1","resolution":{"observed_at":"2026-05-25T04:35:21.971794Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Videodirector: Precise video editing via text-to-video mod- els","venue":null,"work_id":"0ef718ca-eff8-4473-9ae2-a2f630627377","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:6851d3ff82555f5fd4ae41e902ff36b987c2139fc7909f18acb7c156fb6a40fa","observation_id":"46b0d7b4-0fe4-46ac-8dba-fce1c6cfbbe8","resolution":{"observed_at":"2026-05-25T13:30:54.003262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04216","last_updated":"2025-06-04T17:57:43Z","snapshot_observed_at":"2026-08-14T01:59:47.398416Z","submitted_at":"2025-06-04T17:57:43Z","title":"UNIC: Unified In-Context Video Editing","version":1},"cited_work":{"arxiv_id":"2506.04216","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04216","snapshot_observed_at":"2026-07-04T16:29:56.632377Z","title":"Unic: Unified in-context video editing","venue":null,"work_id":"309245ca-25dd-4058-af47-e373bcbb1fdf","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"cited_paper":"/paper/2506.04216","citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:50e16a5937ff86bf94572b81cc766c7aeb573954bc60c88e3fe3327e98adc65f","observation_id":"6ec71593-e655-4d1c-94a2-cfaee7bee513","resolution":{"observed_at":"2026-05-25T04:35:21.938133Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Videograin: Modulat- ing space-time attention for multi-grained video editing","venue":null,"work_id":"c3e2eb6c-fd70-458f-a82e-ca15a40cebac","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:925f8509ecc2bf19549d60396acfba4bf935474bfe24d77c710128a99880fe8c","observation_id":"522a8afb-394e-40f1-97c6-1b8c2f317044","resolution":{"observed_at":"2026-05-25T13:30:54.014754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Videopainter: Any-length video inpainting and editing with plug-and-play context control","venue":null,"work_id":"32b7bd6a-2945-4204-bc19-6402d84cdbb5","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:6ae47a87f31e8d752b8024f5327075fba9ea39257372804e37d2b73d17e2398f","observation_id":"a2010f51-575b-4096-bd28-474704015af2","resolution":{"observed_at":"2026-05-25T13:30:54.019040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Uniedit: A unified tuning-free framework for video motion and appearance editing","venue":null,"work_id":"e2edb729-6634-45a5-b9ce-73bbb2c7c203","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:fd77f5b3a0b13248ad5d8d55d9ad54f1069389452f9bfdb4494e142b396a55cc","observation_id":"35c7567e-a805-4257-b3c3-cdb421d93cb4","resolution":{"observed_at":"2026-05-25T13:30:54.011020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Moonshot: Towards controllable video generation and edit- ing with motion-aware multimodal conditions","venue":null,"work_id":"89915888-3838-412c-9dc9-d5db5bad0a16","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:85fed80e3e70af80cd182aa63293e9b892864465552afdead509ed77ab12663d","observation_id":"d2b5f200-5652-4fb5-9289-ae3a93b9c4fa","resolution":{"observed_at":"2026-05-25T13:30:54.026737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion as shader: 3d-aware video diffusion for versatile video generation control","venue":null,"work_id":"cf820d8d-54d0-454e-9c6d-23fdbb83e140","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:853d5089db454645261c30e93873d29dbcd10348eaa06a61b04418499a1a5df4","observation_id":"aa5d7ff5-6946-414f-bd52-4b0e42061d27","resolution":{"observed_at":"2026-05-25T13:30:53.949471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06268","last_updated":"2025-03-08T16:27:53Z","snapshot_observed_at":"2026-08-13T06:25:18.604515Z","submitted_at":"2025-03-08T16:27:53Z","title":"Get In Video: Add Anything You Want to the Video","version":1},"cited_work":{"arxiv_id":"2503.06268","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.06268","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2503.06268 , year=","venue":null,"work_id":"6be2f6d9-0a13-4243-85cb-38510cf1b258","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"cited_paper":"/paper/2503.06268","citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:df7f4cfeccf2ea45d8f1eacb9bff7dea1e9b90405b246758fb1852b7e1633e2d","observation_id":"8dca4270-44d9-48ce-a287-09f4fe114fea","resolution":{"observed_at":"2026-05-25T04:35:21.955361Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Videoany- door: High-fidelity video object insertion with precise motion control","venue":null,"work_id":"5d0ac8f1-b1c8-470e-b0a0-ebd6cd74c993","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:8cf0c8e925fc7bdd7f95b82f21f040b096ca7775135a1126cb03994cdac9d0ae","observation_id":"069d5c31-df89-4eef-8fc3-dbd0ef9da9b2","resolution":{"observed_at":"2026-05-25T13:30:53.952997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17509","last_updated":"2024-01-30T23:54:43Z","snapshot_observed_at":"2026-08-13T21:20:40.961273Z","submitted_at":"2024-01-30T23:54:43Z","title":"Anything in Any Scene: Photorealistic Video Object Insertion","version":1},"cited_work":{"arxiv_id":"2401.17509","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.17509","snapshot_observed_at":"2026-07-01T21:56:16.325758Z","title":"Anything in any scene: Photorealistic video object insertion","venue":null,"work_id":"f4be8657-ef06-41bb-bd8f-1a6f3597ab22","year":2024},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"cited_paper":"/paper/2401.17509","citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:c3cd30fec489c3a00b5fa7d400bc8afad17bf6e030c64ed2fb3c4b467084b504","observation_id":"04cd073c-de04-4dc7-b6ba-bf0ac6c9c6cd","resolution":{"observed_at":"2026-05-25T04:35:21.923064Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10342","last_updated":"2025-03-13T13:20:54Z","snapshot_observed_at":"2026-08-13T05:05:18.074756Z","submitted_at":"2025-03-13T13:20:54Z","title":"DreamInsert: Zero-Shot Image-to-Video Object Insertion from A Single Image","version":1},"cited_work":{"arxiv_id":"2503.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.10342","snapshot_observed_at":"2026-07-01T21:56:16.338877Z","title":"Dreaminsert: Zero-shot image- to-video object insertion from a single image","venue":null,"work_id":"8aa4df9e-6405-4c2e-9e87-531fad436dcf","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"cited_paper":"/paper/2503.10342","citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:f241ed2d9353bc2ae5a9ee119adff1d368e1a4b1e8db103374c4165806d816c6","observation_id":"a10b0d4f-02aa-469f-b9d1-dd3f9bc0e688","resolution":{"observed_at":"2026-05-25T04:35:21.927961Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.17504","last_updated":"2026-06-29T14:03:15Z","snapshot_observed_at":"2026-08-09T15:46:54.830715Z","submitted_at":"2025-12-19T12:14:36Z","title":"InsertAnywhere: Geometrically Grounded and Optics-Aware Video Object Insertion","version":2},"cited_work":{"arxiv_id":"2512.17504","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.17504","snapshot_observed_at":"2026-07-01T21:56:16.388050Z","title":"Insertanywhere: Bridging 4d scene geometry and diffusion models for realistic video object in- sertion","venue":"cs.CV","work_id":"b106f910-f9e1-4b0c-b2e9-6d745e759e27","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"cited_paper":"/paper/2512.17504","citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:dafe0e992e2f6044c7cb320fc89060250ab36bd0eb86895150a22c0ae6477426","observation_id":"9e369578-4073-4d0a-9d50-6f07e4e56a32","resolution":{"observed_at":"2026-06-30T03:17:25.995003Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.17627","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T13:16:58.071267Z","title":"Omniinsert: Mask-free video insertion of any reference via diffusion transformer models","venue":null,"work_id":"1e5fc414-2590-4513-b621-e06e704cae19","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:11e43ad5706913fd0bc6942b7de38eaf541cc71a971b99936e12f228df0b070d","observation_id":"9c30a616-6684-4f9b-a5e1-b8e1d6b9e2f9","resolution":{"observed_at":"2026-05-25T04:35:21.918603Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08377","last_updated":"2026-07-03T16:46:11Z","snapshot_observed_at":"2026-08-07T16:29:46.498912Z","submitted_at":"2025-10-09T16:01:30Z","title":"UniVideo: Unified Understanding, Generation, and Editing for Videos","version":4},"cited_work":{"arxiv_id":"2510.08377","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.08377","snapshot_observed_at":"2026-07-07T03:17:13.018030Z","title":"Univideo: Unified understanding, generation, and editing for videos","venue":null,"work_id":"c6b943b5-97f1-4afc-bf4e-16761043ecac","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"cited_paper":"/paper/2510.08377","citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:6cc94f453e6c6ad0ef4d3f3c38a2d7c614bf3b1a709f4665a41568a0a3e18b7a","observation_id":"66a067ea-f1a5-4b27-9f52-812908c993ee","resolution":{"observed_at":"2026-07-07T03:17:13.018030Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.09609","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T14:59:55.932742Z","title":"Tele-omni: a unified multimodal framework for video generation and editing","venue":null,"work_id":"e2f03500-7369-45c1-ade1-4213368ea12e","year":2026},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:edd6191e54a7668740e4a2c579b4b534dcfda120d21c907b7a6665578c1cda1b","observation_id":"aa7cf522-517c-492c-88b5-e1e5e82c8900","resolution":{"observed_at":"2026-05-25T04:35:21.898720Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vace: All-in-one video creation and editing","venue":null,"work_id":"ce5072a3-a085-4525-889b-15a8e86f9d1d","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:2c3a7fbc918779e5b487e8354d3ee20c5e4df2d00fc7ba9d3f5d3830ec29f32f","observation_id":"2051b2f6-5f29-466a-aa50-7791dd0c974b","resolution":{"observed_at":"2026-05-25T13:30:54.022877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19907","last_updated":"2025-03-25T17:59:06Z","snapshot_observed_at":"2026-08-13T05:05:18.356671Z","submitted_at":"2025-03-25T17:59:06Z","title":"FullDiT: Multi-Task Video Generative Foundation Model with Full Attention","version":1},"cited_work":{"arxiv_id":"2503.19907","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.19907","snapshot_observed_at":"2026-07-03T17:08:42.921278Z","title":"Fulldit: Multi-task video genera- tive foundation model with full attention","venue":null,"work_id":"d3c75fb5-7649-4107-aec0-9801737dfb8e","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"cited_paper":"/paper/2503.19907","citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:a3f6f851604c54a850cd735c82f7f62463d360f6b4d76fe2466095165e5965f9","observation_id":"7b0e3336-454e-454b-9bb0-99acb4d42399","resolution":{"observed_at":"2026-05-25T04:35:21.904497Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09113","last_updated":"2025-06-28T11:58:23Z","snapshot_observed_at":"2026-08-09T02:36:54.979612Z","submitted_at":"2025-06-10T17:56:11Z","title":"Seedance 1.0: Exploring the Boundaries of Video Generation Models","version":2},"cited_work":{"arxiv_id":"2506.09113","doi":"10.48550/arxiv.2506.09113","metadata_source":"pith","pith_arxiv_id":"2506.09113","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Seedance 1.0: Exploring the Boundaries of Video Generation Models","venue":"cs.CV","work_id":"b2e36b5d-99e4-45b4-9358-64f6d3501983","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"cited_paper":"/paper/2506.09113","citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:f11d328e895548d6625179b77510e6ffd79f44e7e504be4e8a797732ec51696e","observation_id":"d688b603-ab28-4550-84a4-67e3f911945a","resolution":{"observed_at":"2026-05-25T04:35:21.913747Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b1069ee5-c899-4db3-925b-c4b879e29e5f","year":2024},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:43e38fe6097a33d1cffe7f7c24eac0ac35bc74f292b6002123122105573a92e5","observation_id":"e3bcd26b-4641-4bc1-a583-3084a798fba1","resolution":{"observed_at":"2026-05-25T13:30:53.939675Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.18870","last_updated":"2025-11-25T02:52:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-24T08:22:07Z","title":"HunyuanVideo 1.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2511.18870","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.18870","snapshot_observed_at":"2026-07-10T01:46:40.932396Z","title":"HunyuanVideo 1.5 Technical Report","venue":"cs.CV","work_id":"ed898a38-b053-407c-bbce-41561510c1de","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"cited_paper":"/paper/2511.18870","citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:6e623265f58f8c3e38c2a4ec5def6e6cdae0b99e95037f5f2f7680753f5fab68","observation_id":"cadac9a3-cb6d-4ad6-bf7b-8cd27e5ed40f","resolution":{"observed_at":"2026-05-25T04:35:21.950304Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":"2408.06072","doi":"10.48550/arxiv.2408.06072","metadata_source":"pith","pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","venue":"cs.CV","work_id":"f38fc088-12aa-4bf4-9ecd-08d3e797ccb7","year":2024},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:6bc02e7f15b8c979eccabcef551456dc5e6239b000d7ee30c0feaf68d5064c15","observation_id":"01f50e50-7474-467c-b172-490abda28146","resolution":{"observed_at":"2026-05-25T04:35:21.888311Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07826","last_updated":"2026-08-12T13:11:54Z","snapshot_observed_at":"2026-08-15T10:12:08.458626Z","submitted_at":"2025-12-08T18:55:07Z","title":"OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing","version":3},"cited_work":{"arxiv_id":"2512.07826","doi":"10.48550/arxiv.2512.07826","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.07826","snapshot_observed_at":"2026-08-13T02:21:48.005953Z","title":"arXiv preprint arXiv:2512.07826 , year=","venue":"arXiv (Cornell University)","work_id":"c4b3187b-7b77-43e4-a313-26d23620d5aa","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"cited_paper":"/paper/2512.07826","citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:d10d5e0e7f1a84e39b6ec0fd9f692f76462c52d8068dcfdb4bdf356b07004d6d","observation_id":"fd161cf9-f099-4143-9fee-3d6793b67fa6","resolution":{"observed_at":"2026-08-13T02:21:48.005953Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.91186+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":"2312.11805","doi":"10.1038/nrn2888","metadata_source":"pith","pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemini: A Family of Highly Capable Multimodal Models","venue":"cs.CL","work_id":"83f7c85b-3f11-450f-ac0c-64d9745220b2","year":2023},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:93fe15f0d35af940c97712d4914d5f26f030f680d414ee56d840e13958d63e5b","observation_id":"f14a4594-bc96-46a0-9f4e-d9c46f181359","resolution":{"observed_at":"2026-05-25T04:35:21.883387Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Langsam: Language-guided segment anything","venue":null,"work_id":"ea07789d-d2e4-4907-9488-5b6e8b2d04b0","year":2023},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:cb26295f15935151621c557d6a596d7b41a3eedd1770dbeb2cac15f4863c2908","observation_id":"7728fa12-dbec-4cb0-a2a9-a376d6901121","resolution":{"observed_at":"2026-05-25T13:30:53.946155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24873","last_updated":"2025-05-30T17:59:45Z","snapshot_observed_at":"2026-08-12T07:26:46.273952Z","submitted_at":"2025-05-30T17:59:45Z","title":"MiniMax-Remover: Taming Bad Noise Helps Video Object Removal","version":1},"cited_work":{"arxiv_id":"2505.24873","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24873","snapshot_observed_at":"2026-07-02T02:16:26.810645Z","title":"arXiv preprint arXiv:2505.24873 , year=","venue":null,"work_id":"dec9d560-3598-49d7-804a-99efdf9eba09","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"cited_paper":"/paper/2505.24873","citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:77fae1ca4d23c26bc1f8f04f60a9955da3ca0779abaaa54a03544226c19f920e","observation_id":"38ce57cb-28e8-48ca-888d-f22857dbb240","resolution":{"observed_at":"2026-05-25T04:35:21.946875Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.14250","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Omnitransfer: All-in-one framework for spatio-temporal video transfer","venue":null,"work_id":"8fba5d85-5c76-42df-acde-26ccd365d0bd","year":2026},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:23f7659bf0f4a7f876292997b167d3959252c76bfa23272b1d0b834be40b9cf3","observation_id":"6bb9afb9-5e13-45a1-8588-521c726e2234","resolution":{"observed_at":"2026-05-25T04:35:21.942269Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vision transformer with quadrangle attention","venue":null,"work_id":"973d29f8-10e6-4963-8a73-aeb85d4e80d2","year":2024},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:dd8980748f1a2f3364cddc2fbe024d4d1a4a943b1547eeac4e8902078f2c41ee","observation_id":"ab1998ea-4134-450d-aa1b-684e7f97ec7c","resolution":{"observed_at":"2026-05-25T13:30:53.943011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chatgpt","venue":null,"work_id":"dfb989ed-2fd1-43f4-a8e1-a7142327ef5f","year":2026},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:e1b9aec403e6dee8b2baf5af4bba306b6ae41fccf69815b893f7af112206e248","observation_id":"4a44defa-d5ff-4516-b34e-13e86abb3e7a","resolution":{"observed_at":"2026-05-25T13:30:53.934099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pytorch fsdp: Experiences on scaling fully sharded data parallel","venue":null,"work_id":"dca7ec00-a3dc-4354-8a95-399f12cb12a7","year":2023},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:73ccebeb7b7dcb6f60d1d534ec54a69df7f183284aefbc5d19c1d6e50a1e139e","observation_id":"c5a20eea-675b-49ba-a0ba-9fc3af1d71d0","resolution":{"observed_at":"2026-05-25T13:30:53.937086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-11T14:42:37.584016Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-25T04:30:20.593882Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2605.23891"},"observation_digest":"sha256:14ee3b3aa007baed7348b048f2e1dbb08919fbc92bba3df9eebe0291671e9c7a","observation_id":"214b3751-effb-4911-9c9c-79ed698b6e72","resolution":{"observed_at":"2026-05-25T04:35:21.879093Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.23891","last_updated":"2026-05-22T17:54:54Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T18:20:04.168294Z","submitted_at":"2026-05-22T17:54:54Z","title":"Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":1,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":1,"verified_exact":17,"verified_fuzzy":21},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 1 inbound Pith citation observation for arXiv:2605.23891."}