{"as_of":"2026-08-05T15:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f0779e5ac0e1f8c6c75365f9d3a89cb77c3c7028641e7324d07fcdd241299ca3","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-07T09:12:13.460169Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.27322/citation-record","integrity":"/paper/2604.27322/integrity","json":"/paper/2604.27322/citation-record.json","paper":"/paper/2604.27322"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Videopainter: Any- length video inpainting and editing with plug-and-play con- text control","venue":null,"work_id":"a63354db-eef6-4316-8d4d-fa315b0f56ff","year":2025},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:7b2e2f7329f38020598074f78feb64ab7abd3732fbc6fb3171c357978867376d","observation_id":"27971ffd-5916-4281-96c6-641702a5ed35","resolution":{"observed_at":"2026-05-27T08:28:50.609308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dit4sr: Taming diffusion transformer for real-world image super-resolution","venue":null,"work_id":"61bfa786-a746-4e38-bf2d-e6119354ae65","year":2025},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:e016f5cb574461f73eded8a5590208257527c17961b2aa4db0fa42ef7ccf1f98","observation_id":"8b2f663a-a196-45ff-ad94-c02b1365387d","resolution":{"observed_at":"2026-05-27T08:28:50.612307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T09:16:07.203676Z","title":"Scaling recti- fied flow transformers for high-resolution image synthesis","venue":null,"work_id":"a92e35c5-be55-4ec3-80cd-8bf130aa79ac","year":null},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:995fc1c4590389cd7f6c9613a7220181cd5c93ba196c744e555db2652656d0e8","observation_id":"1a3a73f1-396a-4dab-bca6-e215fb1087df","resolution":{"observed_at":"2026-05-27T08:28:50.599889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15641","last_updated":"2025-08-21T15:12:14Z","snapshot_observed_at":"2026-08-05T03:00:06.702446Z","submitted_at":"2025-08-21T15:12:14Z","title":"When and What: Diffusion-Grounded VideoLLM with Entity Aware Segmentation for Long Video Understanding","version":1},"cited_work":{"arxiv_id":"2508.15641","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.15641","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"When and what: Diffusion-grounded videollm with entity aware segmenta- tion for long video understanding.CoRR, abs/2508.15641","venue":null,"work_id":"70c8c4c9-69fd-4116-8b9a-202ed283dd37","year":null},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"cited_paper":"/paper/2508.15641","citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:810f0f6528ee5e19e739178c8243923a0967cb7bd4eee3fd76693d4e85107566","observation_id":"5238bb53-07cb-4d26-88e8-8d378f7169a6","resolution":{"observed_at":"2026-05-12T09:46:27.901967Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dit4edit: Dif- fusion transformer for image editing","venue":null,"work_id":"2825110f-4bec-4519-9891-1c58aea8e7ac","year":2025},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:3a64295c92d4e79741a49c5a628b77f08e3f5085ca4d3bda8c1f99ba6bffb0cd","observation_id":"41f3ffe4-f1fe-4ad0-81f4-76905fad3f41","resolution":{"observed_at":"2026-05-27T08:28:50.605644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vbench: Comprehensive bench- mark suite for video generative models","venue":null,"work_id":"edbc7c5b-6470-418c-9ea6-d13cfd61bc20","year":2024},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:14756598074285a4357e347ae1109641ba30d637d49ae1f156b1fce7044691eb","observation_id":"594290b6-1342-4950-985d-50a564883b0e","resolution":{"observed_at":"2026-05-27T08:28:50.597057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vace: All-in-one video creation and editing.ICCV","venue":null,"work_id":"d381bec1-d724-4723-8286-316d84fa293b","year":2025},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:f45c26f29ac797966ad1c7303d385962866d1c8e4db445cf7757268f55e4e8e3","observation_id":"d7220e8c-ab5f-4fea-9a7c-3beca9de7cee","resolution":{"observed_at":"2026-05-27T08:28:50.588747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dual prompting image restora- tion with diffusion transformers","venue":null,"work_id":"b5029886-ef7f-4cc3-8d34-58d81b0e867a","year":2025},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:2c44d345e9e1c70ace82248c6458056831309e93889f0258b089673e960a9846","observation_id":"3a03f13d-1e38-44a2-9d4e-03a83c6f29d5","resolution":{"observed_at":"2026-05-27T08:28:50.591893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Magiceraser: Erasing any objects via semantics-aware control","venue":null,"work_id":"ffef1bf7-6613-413c-9422-f514fdb4dcd0","year":null},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:384fee51a26db6ae7c85f1ea1360a1afa24610d0edf0625c6bc3dfdb206e1914","observation_id":"d34e8401-0280-41ac-83e1-1bd016ac684f","resolution":{"observed_at":"2026-05-27T08:28:50.594554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10018","last_updated":"2025-01-17T08:03:02Z","snapshot_observed_at":"2026-08-04T08:08:54.687000Z","submitted_at":"2025-01-17T08:03:02Z","title":"DiffuEraser: A Diffusion Model for Video Inpainting","version":1},"cited_work":{"arxiv_id":"2501.10018","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10018","snapshot_observed_at":"2026-07-01T21:56:16.292788Z","title":"Diffueraser: A diffusion model for video inpainting","venue":null,"work_id":"da6ed59a-1887-4660-9404-d89f2ab8ca7c","year":2025},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"cited_paper":"/paper/2501.10018","citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:9ec33616c23476580188ed14bf5e53fa003fb6b6f82cf53cc34704901ff4222f","observation_id":"0b1f6359-30fc-4c2f-9386-2ddffc54cf34","resolution":{"observed_at":"2026-05-12T09:46:27.907977Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:a8e667d5e246f2f193a38867cbedb5225bfdd764496d7eb4216ac9c5fa114afb","observation_id":"ef448042-426f-49a6-9fd7-19e05a98d52c","resolution":{"observed_at":"2026-05-12T09:46:27.926278Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Grig: Data-efficient generative residual image inpainting","venue":null,"work_id":"f2860cb8-756b-4d92-867c-69453d89320c","year":2025},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:f23b36c947785fc8d813cddc1bada529ce64eaeef3582db49e9844cd37338c96","observation_id":"9f0e3821-3f37-4149-803d-0e3f2f35a580","resolution":{"observed_at":"2026-05-27T08:28:50.602608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.07741","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ultraled: Learning to see everything in ultra-high dynamic range scenes.arXiv preprint arXiv:2510.07741","venue":null,"work_id":"e495e5de-72e3-4a04-86a3-013f807c5923","year":2025},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:a50158494386eece24612bb99c05b6a8bb5a7a45edceb383eeea92f4a892ec9d","observation_id":"bbe2f0c0-0b14-4b4c-bbb1-35d37d6ab05d","resolution":{"observed_at":"2026-05-12T09:46:27.921167Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rose: Remove objects with side effects in videos.NeurIPS","venue":null,"work_id":"3bf2ae95-a1f5-4917-bc83-e3b5a65dfc5e","year":2025},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:7184ee2749589fa71ae58a7ff194900097b7790ab7926c113071a144d54626bc","observation_id":"58ab5244-c399-4179-a9c5-90f0d6ee9db2","resolution":{"observed_at":"2026-05-27T08:28:50.615170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gross, and Alexander Sorkine- Hornung","venue":null,"work_id":"0b1c1b77-d512-4b8d-8fbc-d2cef2576f5a","year":2016},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:93ba74078932b361a1af5bef1950a0f83329f62b870f7fb49608aa634da9ac83","observation_id":"bd32d6d2-2b06-4e1d-aacd-16b6c47e0719","resolution":{"observed_at":"2026-05-27T08:28:50.577085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unified transformed t-svd us- ing unfolding tensors for visual inpainting.Computational Visual Media","venue":null,"work_id":"13576093-9260-4689-9bfa-e6d2a9b99781","year":2025},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:257e725dd837b6d3df8f8aa0c77e9532f2245c1afcec7e0dad6f77f1e776f523","observation_id":"ad82d0fc-38c1-478b-9018-7842ea32abb4","resolution":{"observed_at":"2026-05-27T08:28:50.585970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robust unsupervised deep learning for nonblind image deconvolu- tion with inaccurate kernels.TNNLS","venue":null,"work_id":"02877b24-b7a8-4764-9c6f-65af5db28e36","year":2025},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:178721397f5dd526fdb7575c1383e38b2c172043d3a755d34cae5e539a7dd944","observation_id":"74bbdbbd-a049-4f14-98a9-5062f1714711","resolution":{"observed_at":"2026-05-27T08:28:50.570506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Camedit: Continuous cam- era parameter control for photorealistic image editing","venue":null,"work_id":"e6de9cc6-70cb-4252-8379-77f9de729edc","year":2025},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:cf17142142a2380791de0d15ed663f12901d99cb249f09dad835ebc2d69cc15b","observation_id":"11372d12-6da6-4b42-9cb9-d2708bb9bb9c","resolution":{"observed_at":"2026-05-27T08:28:50.573646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Disentangle to fuse: Towards content preservation and cross-modality con- sistency for multi-modality image fusion.TIP","venue":null,"work_id":"11ce7a7c-dd13-45de-8fcf-b74dbde54bba","year":2026},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:3f8add4e88e593eacf8bdbcd67dce4978331e2b4b1f24ab3a15fc631a982e3d0","observation_id":"41d586cf-d7c5-41eb-a917-efdc39c06995","resolution":{"observed_at":"2026-05-27T08:28:50.580080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:907552348aa449677862ff5dca610f9f09d54158cbce20e7d1a9e82cbf49bb16","observation_id":"e1388fe0-f6a8-4fd8-b98c-8f67532be440","resolution":{"observed_at":"2026-05-12T09:46:27.958098Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.16124","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vtinker: Guided flow upsampling and texture mapping for high-resolution video frame interpolation","venue":null,"work_id":"7b8d537f-c700-412c-86c2-1bdba1c2c334","year":2025},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:cb897ff99bb152694b9814773dbad611a0608329fb712c7e7bb3b52caddf2e61","observation_id":"4c0175cd-39a7-4a0c-b05b-fe3b399160a4","resolution":{"observed_at":"2026-05-12T09:46:27.952397Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improved video vae for latent video diffusion model","venue":null,"work_id":"e8809b22-bfc2-4d56-a0fa-bb0493e23ed4","year":2025},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:7a24f3e42c268fbbb20d439568d526453f461bedaec7fe2706c05eacd2851f75","observation_id":"e4a4008a-e0c2-44d0-a905-3c3e29861545","resolution":{"observed_at":"2026-05-27T08:28:50.561618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.03327","last_updated":"2018-09-06T04:19:45Z","snapshot_observed_at":"2026-07-06T07:00:12.122241Z","submitted_at":"2018-09-06T04:19:45Z","title":"YouTube-VOS: A Large-Scale Video Object Segmentation Benchmark","version":1},"cited_work":{"arxiv_id":"1809.03327","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.03327","snapshot_observed_at":"2026-07-08T02:04:26.310872Z","title":"YouTube-VOS: A Large-Scale Video Object Segmentation Benchmark","venue":"cs.CV","work_id":"2798c43d-6f6c-445b-8a43-14cba092aa4b","year":2018},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"cited_paper":"/paper/1809.03327","citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:e7cda458e6d09708f1d23caa5e48eddcd4432b9f72cb09298479bd135bcbb4f2","observation_id":"060bc62b-c9bf-4756-a4a0-2f6b6e69e453","resolution":{"observed_at":"2026-05-12T09:46:27.935892Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":"2408.06072","doi":"10.48550/arxiv.2408.06072","metadata_source":"pith","pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","venue":"cs.CV","work_id":"f38fc088-12aa-4bf4-9ecd-08d3e797ccb7","year":2024},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:9a4bdfae50ccc36edb42290ba0b95dcbb71846c96f5fea548a6d8d368f6518ea","observation_id":"9aeadeb2-12f8-44e8-8017-13fe3d27b7f3","resolution":{"observed_at":"2026-05-12T09:46:27.942783Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efros, Eli Shecht- man, and Oliver Wang","venue":null,"work_id":"e1ae7801-0ab4-4cf0-81b4-1c32b4c5ad84","year":null},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:b9ccf03c12224b45891bc2c770daf45d53bc204ecb7fa5ed91a93178b765a285","observation_id":"ac587384-6989-4e60-8db6-e2e833589bc7","resolution":{"observed_at":"2026-05-27T08:28:50.564749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7a2e435c-d2ec-4bdb-860b-639ae5b91792","year":null},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:327258b9dff7d2350cd97b88d6e49f2016a866c3eb6b436c5f01a58ed52a83c4","observation_id":"162cf907-ab8f-410a-a656-0bac14ff1c92","resolution":{"observed_at":"2026-05-27T08:28:50.567568Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.22298","last_updated":"2025-06-27T15:08:54Z","snapshot_observed_at":"2026-07-06T21:48:40.344916Z","submitted_at":"2025-06-27T15:08:54Z","title":"OutDreamer: Video Outpainting with a Diffusion Transformer","version":1},"cited_work":{"arxiv_id":"2506.22298","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.22298","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Outdreamer: Video out- painting with a diffusion transformer","venue":null,"work_id":"10f6d60c-bbdf-45a3-b173-eb254c88922b","year":2025},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"cited_paper":"/paper/2506.22298","citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:c03fc529f497512a1e0058f189e1883dd75486018791f41f6a935c6afd1a9028","observation_id":"74f876d0-af63-4dc5-a260-0805486c5240","resolution":{"observed_at":"2026-05-12T09:46:27.915463Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Propainter: Improving propagation and transformer for video inpainting","venue":null,"work_id":"cc620a77-1005-4733-853d-380f5bcbe68a","year":2023},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:5d09ff161e7c2e40804181810e76dd7c9543d1eaf9173b44cb1f7520ab631a3b","observation_id":"52c9cf51-1755-493e-a7d6-a9d629368211","resolution":{"observed_at":"2026-05-27T08:28:50.582717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Minimax-remover: Taming bad noise helps video object removal.NeurIPS","venue":null,"work_id":"0df93739-226d-4c72-bc6a-9aa914202ad5","year":null},"citing_paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:13.460169Z"},"links":{"citing_paper":"/paper/2604.27322"},"observation_digest":"sha256:6f3c5b8d88ab319d569f0f478c958235fcb6cde379e96ac8798f940112d0b7f7","observation_id":"6d7057ad-3021-4f55-8898-d756f7b477be","resolution":{"observed_at":"2026-05-27T08:28:50.618776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.27322","last_updated":"2026-04-30T02:08:13Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T02:08:13Z","title":"YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":9,"verified_fuzzy":19},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2604.27322."}