{"as_of":"2026-08-08T03:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bf449379730e5d4be27bb808dd6a03766e74dac4fef65f25805e37835f30f4cc","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:44:19.512242Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T17:06:28.335731Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T17:08:00.850727Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"cited_work":{"arxiv_id":"2505.21205","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21205","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sci-fi: Sym- metric constraint for frame inbetweening","venue":null,"work_id":"ee55270b-f4b5-4e9b-83bb-384c34deea10","year":2025},"citing_paper":{"arxiv_id":"2604.03819","last_updated":"2026-04-04T18:00:05Z","snapshot_observed_at":"2026-07-06T22:52:57.182669Z","submitted_at":"2026-04-04T18:00:05Z","title":"ActivityForensics: A Comprehensive Benchmark for Localizing Manipulated Activity in Videos","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T17:06:28.335731Z"},"links":{"cited_paper":"/paper/2505.21205","citing_paper":"/paper/2604.03819"},"observation_digest":"sha256:74b7d7491987a6ed3e60245c2274194ccb051c853d871c5408af9b80f4d0d018","observation_id":"f6c3b667-bbdd-497a-b11b-42875d281bac","resolution":{"observed_at":"2026-05-13T17:08:00.852371Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.21205/citation-record","integrity":"/paper/2505.21205/integrity","json":"/paper/2505.21205/citation-record.json","paper":"/paper/2505.21205"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T13:44:13.215146Z","title":"Qwen2.5-vl technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:13.215146Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:b4d3bcd53d1419ff7cd7cbeb355c17a2455a506d9dda1c2f0d9cf4b5c82a96fa","observation_id":"4083f215-2d0b-4ff4-8dfd-26d1d7d15862","resolution":{"observed_at":"2026-08-07T13:44:13.215146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-07T13:44:13.282358Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:13.282358Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:06ab74a111e9cb36959e52f63955f70c8f2eea523ec9c5aca5471df48a3dc1cf","observation_id":"91cf9163-01d5-42e6-bffd-8366d7b65d4d","resolution":{"observed_at":"2026-08-07T13:44:13.282358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:13.370711Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:13.370711Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:1057ff432dca70154dcbfabe1eeb8938b51a652c282241b4ee1638b0f74d9978","observation_id":"fe5f045d-8542-41e2-9e7f-c72cf97047f7","resolution":{"observed_at":"2026-08-07T13:44:13.370711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:25.928663Z","title":"Ldmvfi: Video frame interpolation with latent diffusion models","venue":null,"work_id":"d1cadce0-668f-41f6-b34d-5d0fd5fa9c4c","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:13.445402Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:09bb0c11803fa923a09a336b98071d7decd279b3ec9ae9e55ffff85548b9a707","observation_id":"36e3177e-12fa-40ab-ab33-cedb9a39643c","resolution":{"observed_at":"2026-08-07T13:44:26.051045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:13.568129Z","title":"Structure and content-guided video synthesis with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:13.568129Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:7b18d7a4915f66bff2a4e6be764bb002f6fe6b9dfc4077289c68e32f391ff50c","observation_id":"50bce9f9-4440-408b-9975-422c59022315","resolution":{"observed_at":"2026-08-07T13:44:13.568129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:25.702594Z","title":"Cogvideox-interpolation","venue":null,"work_id":"6541dbab-c9c1-45ec-b376-b5b2d46f0a2f","year":null},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:13.665715Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:5aa6fd47ecec5dea22c5226ce8259dc7975a65840b4a6f94dfa3b4e018305684","observation_id":"315ea3b9-aa4a-4c1f-8c93-58d2edcfa574","resolution":{"observed_at":"2026-08-07T13:44:25.787317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:25.429721Z","title":"Explo- rative inbetweening of time and space","venue":null,"work_id":"0cb8c673-2980-490a-b547-7537f7ed4169","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:13.748103Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:88f09501e597a4c6b29ebd4e3c2983bbff5b2ff8e5246d2597fffc5ce677407a","observation_id":"e7a27848-8200-4a80-83cb-cb58518f3a83","resolution":{"observed_at":"2026-08-07T13:44:25.594192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10592","last_updated":"2025-03-13T17:42:01Z","snapshot_observed_at":"2026-08-07T17:06:18.240718Z","submitted_at":"2025-03-13T17:42:01Z","title":"CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10592","snapshot_observed_at":"2026-08-07T13:44:13.839755Z","title":"Cameractrl ii: Dynamic scene exploration via camera-controlled video diffusion models.arXiv preprint arXiv:2503.10592, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:13.839755Z"},"links":{"cited_paper":"/paper/2503.10592","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:e363c4d3e643c24a03cbf7a66c6cc09b1e33cf327e58b404125b953444011261","observation_id":"c8cf9677-74b7-480d-b138-b846c3436546","resolution":{"observed_at":"2026-08-07T13:44:13.839755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:13.939554Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:13.939554Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:db6ba6e45be885360eec038d2aa4f04baee4bac8798b7fd8fe0e682501581df2","observation_id":"770e205b-16f1-49aa-98ec-f2939f1cd2fa","resolution":{"observed_at":"2026-08-07T13:44:13.939554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:14.037991Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.037991Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:85767f99b7f472178048b3eb710288b842e95fd5f0431d85c2364c418d677f9b","observation_id":"5cdaad8c-5c21-49de-9c15-759eb8d0ad52","resolution":{"observed_at":"2026-08-07T13:44:14.037991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:25.259066Z","title":"Real-time intermediate flow estimation for video frame interpolation","venue":null,"work_id":"d45746f6-089b-4234-b5c8-233c47c6a0cd","year":2022},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.124042Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:bdc10c06affb25ac8c0931a0d5fa6e21fc817f1b7b1a1bcb9719eb4c5aabce66","observation_id":"7f84390d-e96d-412c-b751-eb93cf9dd8c8","resolution":{"observed_at":"2026-08-07T13:44:25.296929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:25.228994Z","title":"Vbench: Comprehensive bench- mark suite for video generative models","venue":null,"work_id":"f6f55d89-e921-4452-a2d8-419d5ccc32ff","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.201840Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:d62ab2c1f2387bb782dbbc7eed25cfd0ec8ee60646a4046954ca246e15e02398","observation_id":"1066a7ee-dbe3-4cab-a7a1-f9884215aba5","resolution":{"observed_at":"2026-08-07T13:44:25.251616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T13:44:14.302422Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.302422Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:643953d75f8d45f7234c7ba08f9ca455f12f3e926f9b619121033eab22c981ce","observation_id":"52d73354-388f-461b-8f5d-d36850f3ad91","resolution":{"observed_at":"2026-08-07T13:44:14.302422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:25.073313Z","title":"Auto-encoding vari- ational {Bayes}","venue":null,"work_id":"2584257e-b738-4878-b0a3-b1be60e7b22b","year":null},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.417358Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:8d7027cf3105bdc8c85643ef618b0b66d2d5673b2cdb0ddb426269641618a44b","observation_id":"6ba6ca37-04de-4c1e-9178-c6efc77209ee","resolution":{"observed_at":"2026-08-07T13:44:25.128531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:14.495206Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.495206Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:2ec7606d3baeaab4b6483cc5c1163db463289609d8dc5f8cbbb220a583f8c0d4","observation_id":"4f7d281f-a584-42ae-8a80-1abe94cf8982","resolution":{"observed_at":"2026-08-07T13:44:14.495206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:24.828775Z","title":"Amt: All-pairs multi-field transforms for efficient frame interpolation","venue":null,"work_id":"cc5d717e-e560-46ad-9c71-0da8d7de3824","year":2023},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.571201Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:4b83285e3d57e9a5d25c4aff3a4bb92c04d645b3c0f11c06f958f251b1843cfa","observation_id":"282ff450-f7ee-41b0-807b-89cf13e661ea","resolution":{"observed_at":"2026-08-07T13:44:24.965344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17459","last_updated":"2025-04-11T12:31:07Z","snapshot_observed_at":"2026-07-06T19:57:18.481261Z","submitted_at":"2024-11-26T14:23:53Z","title":"WF-VAE: Enhancing Video VAE by Wavelet-Driven Energy Flow for Latent Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17459","snapshot_observed_at":"2026-08-07T13:44:14.655924Z","title":"Wf-vae: Enhancing video vae by wavelet-driven energy flow for latent video diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.655924Z"},"links":{"cited_paper":"/paper/2411.17459","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:86fee8d3e57b6a33ea3ecd07a6e52d3c4a43b0b920aff2b3784df3c1298d3ea2","observation_id":"6b679f74-e21f-4acd-a390-7c73e96a1162","resolution":{"observed_at":"2026-08-07T13:44:14.655924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:24.652147Z","title":"Ctrl- adapter: An efficient and versatile framework for adapting diverse controls to any diffusion model","venue":null,"work_id":"b889362a-ebea-48a8-b129-e1502a1e46f6","year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.751884Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:c730da81d9005e14f398fc319b4f7f84b983e2f7e8ac02aaa4f73402282b8fda","observation_id":"42595bf1-1f41-48cd-b3ba-88a95c2f9f2a","resolution":{"observed_at":"2026-08-07T13:44:24.740619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:24.469153Z","title":"Sparse global matching for video frame interpolation with large motion","venue":null,"work_id":"4e706a03-f167-478f-9298-0de480277397","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.858731Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:ba7f021d84f524ac867542e3b8f1f0d9acf0dd6ce5073f9c3240cf0213aecdd0","observation_id":"bcb63fe6-866a-4c18-864d-808c8b322aa3","resolution":{"observed_at":"2026-08-07T13:44:24.569317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16767","last_updated":"2025-06-25T07:19:44Z","snapshot_observed_at":"2026-08-01T22:53:31.767507Z","submitted_at":"2024-08-29T17:59:40Z","title":"ReconX: Reconstruct Any Scene from Sparse Views with Video Diffusion Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16767","snapshot_observed_at":"2026-08-07T13:44:14.960017Z","title":"Re- conx: Reconstruct any scene from sparse views with video diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.960017Z"},"links":{"cited_paper":"/paper/2408.16767","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:efeb1fe96eb6525c33adb48490260947f64075ed6b3d05378e6b94014dc088dd","observation_id":"98023b27-27c5-4915-8ab1-70f79d57bdef","resolution":{"observed_at":"2026-08-07T13:44:14.960017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:24.299763Z","title":"Video frame interpolation via direct synthesis with the event- based reference","venue":null,"work_id":"84d4ebcb-96bf-4ed3-a935-03d1d1a6f2c2","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:15.058691Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:e85cea56ae474738c3ffa0326b9077e506021d7d8cd2dbe9de1071d72c292cca","observation_id":"d2949bcf-9e25-48f8-a09f-bfd2d63b167a","resolution":{"observed_at":"2026-08-07T13:44:24.392603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03048","last_updated":"2025-05-01T09:40:21Z","snapshot_observed_at":"2026-08-02T13:01:06.918463Z","submitted_at":"2024-01-05T19:55:15Z","title":"Latte: Latent Diffusion Transformer for Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03048","snapshot_observed_at":"2026-08-07T13:44:15.127935Z","title":"Latte: Latent diffusion transformer for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:15.127935Z"},"links":{"cited_paper":"/paper/2401.03048","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:201f68d9750197eae50660b8e51ae2bb8a2f8b2fe61d8b2fc38081c52ba7e808","observation_id":"379107de-b39c-4ab7-ab3b-d3c7455bd43f","resolution":{"observed_at":"2026-08-07T13:44:15.127935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:24.163821Z","title":"T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models","venue":null,"work_id":"6432bb30-a3aa-44f6-bbb5-c29be0d37b82","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:15.198513Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:4027f9637c548e8bdac736a11f12f021308bc79180720d1364ed756b49dfb78e","observation_id":"7309618a-2a15-4726-9456-f012e918725d","resolution":{"observed_at":"2026-08-07T13:44:24.228345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:23.905094Z","title":"Softmax splatting for video frame interpolation","venue":null,"work_id":"108ff5d1-d0de-46b5-bc8e-09b3e23ea837","year":2020},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:15.284892Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:2d11959088ac6dfafbc4d2152448ad3e1eb53ce7316f5a85127be00969104c37","observation_id":"0ce8ed17-743f-4156-96d7-1a6f4eec85b0","resolution":{"observed_at":"2026-08-07T13:44:24.061779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:15.398968Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:15.398968Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:51e8cbffd1fd9e36f16cfb6bd1b4f15bc50c08ba0cd4ff3fd8d9fbafc22a6780","observation_id":"a082bba9-3577-426f-bb53-c96418e3cb1f","resolution":{"observed_at":"2026-08-07T13:44:15.398968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06070","last_updated":"2025-03-08T08:43:03Z","snapshot_observed_at":"2026-07-06T18:59:34.520274Z","submitted_at":"2024-08-12T11:41:18Z","title":"ControlNeXt: Powerful and Efficient Control for Image and Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06070","snapshot_observed_at":"2026-08-07T13:44:15.473154Z","title":"Controlnext: Powerful and effi- cient control for image and video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:15.473154Z"},"links":{"cited_paper":"/paper/2408.06070","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:ea6986527d2167f0405e30eeb309956e7ee773a409a7940112ae243e55d2cbbe","observation_id":"0a0f5c52-5230-455c-aff1-d072e49a646a","resolution":{"observed_at":"2026-08-07T13:44:15.473154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.00675","last_updated":"2018-03-01T17:50:08Z","snapshot_observed_at":"2026-08-02T10:51:13.194643Z","submitted_at":"2017-04-03T16:44:46Z","title":"The 2017 DAVIS Challenge on Video Object Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.00675","snapshot_observed_at":"2026-08-07T13:44:15.593897Z","title":"The 2017 davis challenge on video object segmentation.arXiv preprint arXiv:1704.00675, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:15.593897Z"},"links":{"cited_paper":"/paper/1704.00675","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:595293066fca2663566f00f23ee1bcd915cfa418d3c08604706f609d5684fbcd","observation_id":"650e3eee-1a48-4f02-bdd7-12e6fd3e9746","resolution":{"observed_at":"2026-08-07T13:44:15.593897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:23.542333Z","title":"Film: Frame inter- polation for large motion","venue":null,"work_id":"ecee8646-4977-45a4-84e4-d462341bafd1","year":2022},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:15.765845Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:edee22efc304f3bef56313b4df8342b0d6379bcb49bd0e8fa4932df5f13e20be","observation_id":"f2c4342a-b2d4-4761-9c37-94d615d0e8de","resolution":{"observed_at":"2026-08-07T13:44:23.740560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:15.903639Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:15.903639Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:f795060a356871e29e00112f53d2dcdca3e31d87fd42bf0a691dcc60f5ea9c25","observation_id":"52f9d938-4cc6-410d-9a57-d7db17c42a2c","resolution":{"observed_at":"2026-08-07T13:44:15.903639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:23.263178Z","title":"Progressive distillation for fast sampling of diffusion models","venue":null,"work_id":"89cd643e-b05b-4263-bc67-09d977782b5b","year":2022},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:16.085548Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:2a5efa338cd53e45a11cb7b80581e1dd852b575b4eff7d0891e9f963a03478e9","observation_id":"b76c623c-f13e-4152-a981-e41ce512aca5","resolution":{"observed_at":"2026-08-07T13:44:23.367038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:23.049965Z","title":"Bridging the gap: Sketch-aware interpola- tion network for high-quality animation sketch inbetween- ing","venue":null,"work_id":"fffe47f8-854e-436a-9465-c37090283921","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:16.227929Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:13d669c437a3b3cd23f5caf780e11f7847a808d5eb94d3ed7a221d272af92483","observation_id":"65173eec-2a2f-488a-910d-5017a9890550","resolution":{"observed_at":"2026-08-07T13:44:23.154460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:22.738938Z","title":"Deep geometrized cartoon line inbe- tweening","venue":null,"work_id":"2b115bbf-e2ef-45cb-93b2-fe808ace0846","year":2023},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:16.363521Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:ff48062f429ff1beeab66f63a5ad48774d2bfa9b7f80bb91cd27094f102703de","observation_id":"12977f97-3890-45d1-9c08-a4f4baa393ee","resolution":{"observed_at":"2026-08-07T13:44:22.858494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13190","last_updated":"2025-01-07T22:06:07Z","snapshot_observed_at":"2026-08-03T18:26:01.751180Z","submitted_at":"2024-12-17T18:59:33Z","title":"MotionBridge: Dynamic Video Inbetweening with Flexible Controls","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13190","snapshot_observed_at":"2026-08-07T13:44:16.479200Z","title":"Motionbridge: Dynamic video inbetweening with flexible controls","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:16.479200Z"},"links":{"cited_paper":"/paper/2412.13190","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:34b1ccaf50ba0cb456ff51f986602df46c9af53168ca232256d939322358262c","observation_id":"d7d44b34-37dc-46f0-bef1-183f57295d0c","resolution":{"observed_at":"2026-08-07T13:44:16.479200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:22.527123Z","title":"Fvd: A new metric for video generation","venue":null,"work_id":"be77776e-89d0-4b84-ab4d-cea4e2eacd13","year":null},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:16.574603Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:7701394f528891f6f63f1824fd7796b3d85d8d3e4c5969a232385cbac2b67d25","observation_id":"0e8f3bf3-5e4f-44c0-85a3-574d2f6a28ba","resolution":{"observed_at":"2026-08-07T13:44:22.624747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:22.338386Z","title":"Neural discrete representation learning","venue":null,"work_id":"143af48e-7134-468e-8bb1-9e788ce0f71a","year":2017},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:16.678861Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:bee9b3756bf8c3e906b50f9b625bcce1bbc6863252d4a89ab85252ab885b5a06","observation_id":"2992bcdf-f234-4190-9e6f-808b1766c4d5","resolution":{"observed_at":"2026-08-07T13:44:22.405551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:16.750458Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:16.750458Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:88052014ccf842fed250883157e84786ac27bdc0b1bc5c1410dea42e4edd88db","observation_id":"337a7518-82be-40c8-9be5-b4324199233e","resolution":{"observed_at":"2026-08-07T13:44:16.750458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-07T13:44:16.895481Z","title":"Wan: Open and advanced large-scale video gen- erative models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:16.895481Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:dabb1e9cc951b183256155f9de20d1e0cc18a19abc3b6d9bb2b624ea07c37788","observation_id":"0ffcfd94-c333-4aa9-845a-655f376d7000","resolution":{"observed_at":"2026-08-07T13:44:16.895481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18978","last_updated":"2024-11-04T13:37:31Z","snapshot_observed_at":"2026-07-06T19:39:15.025945Z","submitted_at":"2024-10-24T17:59:51Z","title":"Framer: Interactive Frame Interpolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18978","snapshot_observed_at":"2026-08-07T13:44:17.023877Z","title":"Framer: Interactive frame interpolation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:17.023877Z"},"links":{"cited_paper":"/paper/2410.18978","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:07250068285f8f0893c914104c23726195daeb1846df4526acacada89fcd37ed","observation_id":"20903de9-30b4-4f01-9f56-64b76f9fed30","resolution":{"observed_at":"2026-08-07T13:44:17.023877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:22.153687Z","title":"Generative inbetweening: Adapting image-to-video models for keyframe interpolation","venue":null,"work_id":"c8cc71d2-8cbc-4239-990d-50cc5cb08817","year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:17.133306Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:7a701766ea43cfe2960b3cc56acd542edbe059418a2997a35bf1c0ee3215c61a","observation_id":"f990fba8-931d-43a9-8629-75f9da8b4bb4","resolution":{"observed_at":"2026-08-07T13:44:22.252155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:21.930710Z","title":"Perception-oriented video frame interpolation via asymmetric blending","venue":null,"work_id":"387f671c-9ace-491c-8b57-c5f10e8ab1c1","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:17.265922Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:30d2389e1a34ef564b77428b0905149b2db00370954a2eb50396886b3d842eca","observation_id":"9895fa43-c504-41dd-a36e-b9e711beef63","resolution":{"observed_at":"2026-08-07T13:44:22.041297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:21.733872Z","title":"Tooncrafter: Generative cartoon interpolation","venue":null,"work_id":"5f08da81-9b1e-4e99-b55c-b57b3211daf3","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:17.389735Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:25fd12a3bf0c617416a67cb2cf61edc8c6a7b4b55087922d86b1a84336427b2f","observation_id":"e51f64f4-8104-4e17-8d6f-096049676683","resolution":{"observed_at":"2026-08-07T13:44:21.831663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:17.511227Z","title":"Dynamicrafter: Animating open-domain images with video diffusion priors","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:17.511227Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:3a69eb5a55b95e5d91516cf5e79841e4b85b9d6d2276a8d3af66885cf235f2bc","observation_id":"33fc56b0-83f5-46a6-9135-7176a2f9efdb","resolution":{"observed_at":"2026-08-07T13:44:17.511227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:21.533926Z","title":"Vibidsam- pler: Enhancing video interpolation using bidirectional dif- fusion sampler","venue":null,"work_id":"e02a82c8-84cd-4cd5-908e-6ad158060006","year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:17.627682Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:5a3ab5f438ac5ae8df86eaa5d553580fc5dc041c39d321f6252e5f10f81ae17a","observation_id":"8be95040-7c99-4bd3-8f52-9e8c470c43e8","resolution":{"observed_at":"2026-08-07T13:44:21.607776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:21.356631Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":"d72fc2f8-c870-4e7d-ab77-5ad75eaf063e","year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:17.742249Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:f72f608551db24f52fff31e8dbde0157be2c7523f079e4e427c1d143091eb2a7","observation_id":"eac77d75-735e-4e70-84e4-5349c6d145f1","resolution":{"observed_at":"2026-08-07T13:44:21.452441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:21.167170Z","title":"Language model beats diffusion-tokenizer is key to visual generation","venue":null,"work_id":"58e46837-7847-49c1-a8da-5b1bdeacb2c4","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:17.831603Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:1c5997238b4798da0eb4fb2e2cd09e617b46eb9a5837aa6a3a0b83466add1770","observation_id":"cdab3e01-b5f6-49b3-8a51-2f418d5672f6","resolution":{"observed_at":"2026-08-07T13:44:21.270560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:20.962341Z","title":"Extracting motion and ap- pearance via inter-frame attention for efficient video frame interpolation","venue":null,"work_id":"f75730ea-0e7e-45b9-8397-ffacdc1acf23","year":2023},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:18.020812Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:1e244b65a04d983ccaa194a8fe9dbb0d78f85bb78050e3244fce30e2073c5fb1","observation_id":"55dd1599-8b31-4768-898d-659701fa9f1a","resolution":{"observed_at":"2026-08-07T13:44:21.067310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03699","last_updated":"2025-03-08T08:22:34Z","snapshot_observed_at":"2026-07-06T20:17:33.819458Z","submitted_at":"2025-01-07T11:03:43Z","title":"Motion-Aware Generative Frame Interpolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03699","snapshot_observed_at":"2026-08-07T13:44:18.167633Z","title":"Motion-aware generative frame in- terpolation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:18.167633Z"},"links":{"cited_paper":"/paper/2501.03699","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:9e987ff8a9184eb228afbfaed77555f092404642dbf38481f053bbcaacaee3a6","observation_id":"a035304f-5cc7-4ada-b270-91f1466fa78e","resolution":{"observed_at":"2026-08-07T13:44:18.167633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:20.768556Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"90656108-e4df-4b01-b48f-0514168d25ab","year":2023},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:18.292960Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:af7665e84235a956514324df4bce7d9c503687dde307dda3d970d833696043af","observation_id":"4b8cc3d2-8a3b-4356-9923-22df4873d82d","resolution":{"observed_at":"2026-08-07T13:44:20.843896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:20.625540Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":"e8522f57-2867-41e6-b890-a927f127a989","year":2018},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:18.466764Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:e7c0d610c16742ed6c437f9ad1ba72078f1ce0a86f6dc09fa330d60f3a88596c","observation_id":"9e0c3997-f7df-4bb9-bad4-01093910cf73","resolution":{"observed_at":"2026-08-07T13:44:20.699502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13077","last_updated":"2023-05-22T14:48:53Z","snapshot_observed_at":"2026-08-07T10:11:05.104768Z","submitted_at":"2023-05-22T14:48:53Z","title":"ControlVideo: Training-free Controllable Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13077","snapshot_observed_at":"2026-08-07T13:44:18.599871Z","title":"Controlvideo: Training-free controllable text-to-video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:18.599871Z"},"links":{"cited_paper":"/paper/2305.13077","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:07692a98029629be3969f863dc6032adf9575f7135157bf605c9bcb2ecdb0aeb","observation_id":"e40a1cf4-b60b-4a78-ad8a-2157fc8515e1","resolution":{"observed_at":"2026-08-07T13:44:18.599871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07027","last_updated":"2025-03-10T08:07:17Z","snapshot_observed_at":"2026-08-07T17:17:43.519906Z","submitted_at":"2025-03-10T08:07:17Z","title":"EasyControl: Adding Efficient and Flexible Control for Diffusion Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07027","snapshot_observed_at":"2026-08-07T13:44:18.807929Z","title":"Easycontrol: Adding efficient and flexible control for diffusion transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:18.807929Z"},"links":{"cited_paper":"/paper/2503.07027","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:a6091366740cda57cf2072fe60b0337d90d6c6d9f78f4ca1973aebc55c8a34af","observation_id":"10505a36-3525-4e05-aa77-2f8a7ff79f29","resolution":{"observed_at":"2026-08-07T13:44:18.807929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21705","last_updated":"2025-03-14T03:03:31Z","snapshot_observed_at":"2026-07-06T18:55:07.177656Z","submitted_at":"2024-07-31T15:53:20Z","title":"Tora: Trajectory-oriented Diffusion Transformer for Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21705","snapshot_observed_at":"2026-08-07T13:44:18.994805Z","title":"Tora: Trajectory-oriented diffusion transformer for video genera- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:18.994805Z"},"links":{"cited_paper":"/paper/2407.21705","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:e5d0db72fa27896b5827245ab4c3ddf80382f1daff83dfbef93e80c7771db07d","observation_id":"271e9707-b604-46c1-894a-43d5a354a79d","resolution":{"observed_at":"2026-08-07T13:44:18.994805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:20.484270Z","title":"Eden: Enhanced diffusion for high-quality large-motion video frame interpo- lation","venue":null,"work_id":"6c56611e-90e0-4402-b7fe-2fe0ae085f10","year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:19.118796Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:e4a13d01264e0397b97cfb6400c76c4705cb349516cd1f7174a44ae65235c385","observation_id":"886b2726-17fe-4672-9697-cd674b762ce0","resolution":{"observed_at":"2026-08-07T13:44:20.543018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:20.355136Z","title":"Clearer frames, anytime: Re- solving velocity ambiguity in video frame interpolation","venue":null,"work_id":"423c9125-f4de-4e9f-b19e-67a1f6dc4454","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:19.234123Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:bf93bdf44f897ee46f45aca33a2acea0ad583263b38badfa88df088212ebc07a","observation_id":"0ab0cd57-b763-4bac-be99-d8e766e4520c","resolution":{"observed_at":"2026-08-07T13:44:20.415759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:20.173195Z","title":"Generative inbetweening through frame- wise conditions-driven video generation","venue":null,"work_id":"b21c21de-7905-46e4-9e48-6f48342aa144","year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:19.379474Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:b15fcd6dfb65e4639e5484a1865cb34b3fa7ae5d06f3748324a25fb77b8a54d4","observation_id":"63187452-6524-42fc-ae2c-e1ed5c7ce038","resolution":{"observed_at":"2026-08-07T13:44:20.282869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:19.860580Z","title":"This is the first and last frame of a video clip. Describe this video in one continuous para- graph","venue":null,"work_id":"58948ef5-b5fb-4e48-9270-913c66d936c7","year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:19.512242Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:6cff11aaa3320acbaa518c65056e0db66ade21d7b58fc5aabf38d07f7b605942","observation_id":"428c41e7-2801-4601-9163-617065fb8dda","resolution":{"observed_at":"2026-08-07T13:44:20.044526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T13:30:40.001547Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":31},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 1 inbound Pith citation observation for arXiv:2505.21205."}