{"as_of":"2026-08-09T13:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c1a846fd8ab98e6d4555f830c79555bd9970bfcdb2e67b2b1b54a72c2e19fff4","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:39:52.269953Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T16:56:31.849924Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05173","snapshot_observed_at":"2026-08-02T16:56:31.849924Z","title":"arXiv preprint arXiv:2507.05173 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.01700","last_updated":"2026-07-20T03:39:00Z","snapshot_observed_at":"2026-08-04T07:22:17.279993Z","submitted_at":"2026-04-02T06:58:46Z","title":"Can Video Diffusion Models Predict Past Frames? Bidirectional Cycle Consistency for Reversible Interpolation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T16:56:31.849924Z"},"links":{"cited_paper":"/paper/2507.05173","citing_paper":"/paper/2604.01700"},"observation_digest":"sha256:5d8d258c07a04af23ab2797a365f3cbb6f64e558d96de142920b8ac073bdc3cf","observation_id":"739ea156-5a79-4409-817e-d6183db6acde","resolution":{"observed_at":"2026-08-02T16:56:31.849924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.05173/citation-record","integrity":"/paper/2507.05173/integrity","json":"/paper/2507.05173/citation-record.json","paper":"/paper/2507.05173"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:58.233642Z","title":"aesthetic - predictor","venue":null,"work_id":"9265ee0d-cee5-45f6-8828-452673e1921c","year":2022},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:47.777534Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:28a1b7bf4e51e37639691d9d01cc04819a12323efdc6050e7c86a60d0252a0f8","observation_id":"c3866e5c-3458-4063-8fc6-99f211de9314","resolution":{"observed_at":"2026-08-06T19:39:58.334446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T19:39:47.868782Z","title":"Qwen2.5-vl technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:47.868782Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:02a1eb14a481aaff92ac6146e5290c05a9c92ab87e3d60e48034f1f3f7084ebb","observation_id":"e4618650-0634-41ea-96d9-d33540ef32a9","resolution":{"observed_at":"2026-08-06T19:39:47.868782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-06T19:39:47.942447Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:47.942447Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:a7f91b08bac2b7e01600a8a8e5202f52f4b3d217f752c0081fae50b4795fc13a","observation_id":"aed9b34b-e77b-4350-a64a-653778f785f5","resolution":{"observed_at":"2026-08-06T19:39:47.942447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:58.006169Z","title":"Kernel-based frame interpolation for spatio-temporally adaptive rendering","venue":null,"work_id":"93003399-e3f5-48b3-8159-c59676588e05","year":2023},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.057504Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:9f97afa17d555e58e456f744fffd3bc83bb2f7c8f0b10ff27528cca351b6b16b","observation_id":"1c942776-5cd8-469d-b86f-50bfaeb98c64","resolution":{"observed_at":"2026-08-06T19:39:58.118181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:57.780566Z","title":"Video generation models as world simulators","venue":null,"work_id":"bd1629f2-2aad-4d07-88c5-61d2ca334be7","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.119011Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:8d4e3bccd89daa8d1d438a156ed8cdac6ce9c4ba25d426c52770c36e9d6095d2","observation_id":"356a3f8e-9222-4054-9e3f-6379786d5205","resolution":{"observed_at":"2026-08-06T19:39:57.903777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:57.650195Z","title":"Multiple video frame interpolation via enhanced deformable separable convolution","venue":null,"work_id":"8e9689b9-2b16-4258-b9a9-1b46274a86e3","year":2021},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.226734Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:0afea10df74db447f8379484c495f182adb3ea954b41a37a8549e779dcc589ad","observation_id":"7d6cd1d9-520e-41ce-99ae-92e88c9c1291","resolution":{"observed_at":"2026-08-06T19:39:57.723170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:57.451395Z","title":"Channel attention is all you need for video frame interpolation","venue":null,"work_id":"2cca9406-33dc-43cf-9c74-f337730336b5","year":2020},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.313796Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:ae8f4ddd5f623d2581d8adf6c9e89c78f3e10b6d89294f8941080c794d9e8319","observation_id":"60927938-0081-4990-8cf4-8ab3a6a8c326","resolution":{"observed_at":"2026-08-06T19:39:57.535090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:57.238853Z","title":"Ldmvfi: Video frame interpolation with latent diffusion models","venue":null,"work_id":"03d1a16f-ae03-4b25-a7a2-a62ba016e400","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.439925Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:834329a2f1308b70937b2599dc0d8b21b846f8682cc9304e17a76a6f0ee48d8a","observation_id":"819b8722-35d3-4590-9a7b-4ec83415fc01","resolution":{"observed_at":"2026-08-06T19:39:57.367129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:57.086126Z","title":"Video frame interpo- lation with stereo event and intensity cameras","venue":null,"work_id":"5c4b63e3-9755-497b-9b27-bb31eae784b9","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.537218Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:e63315ef52659605ebefe180c07fc9d2b9016179f89d9cdb86976f033a4cb984","observation_id":"64789245-439b-499a-8b2a-7bec69ed9d7c","resolution":{"observed_at":"2026-08-06T19:39:57.157647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:56.975904Z","title":"Video frame interpolation: A comprehensive survey","venue":null,"work_id":"82c52a62-c27d-4e43-bbb4-42a292c6078e","year":2023},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.614750Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:ba3382cc8e639f603db9ad60e296910f4d41c48aef46a25231c021d2efc43489","observation_id":"4b86caf7-7916-405a-ae54-344152009b39","resolution":{"observed_at":"2026-08-06T19:39:57.024520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:56.810625Z","title":"Explorative inbetweening of time and space","venue":null,"work_id":"1d7cec72-56a1-4f52-a4f0-3deafc26ba1f","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.707627Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:1127ac2133b9ca2e59f9f9266be9815b4cfba1b19549c3eb348d66768ee59946","observation_id":"22c14a30-c2e6-4ec8-b309-515e194c4c81","resolution":{"observed_at":"2026-08-06T19:39:56.895728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-06T19:39:48.804162Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.804162Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:9cd4c8cd1fdaf21045f75bda8633769c3dd5005883b59666d8d70d33e132cd30","observation_id":"42c71690-8b71-44dd-8891-2a8a316648d1","resolution":{"observed_at":"2026-08-06T19:39:48.804162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:56.546938Z","title":"Video diffusion models","venue":null,"work_id":"93dfb77d-f570-4e4c-bc5f-7d9023b53ea6","year":2022},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.889838Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:e1c8e10c93fb7e0068a4cbe5c134c6859b476229abe6202dc1eb1f2289c8e74e","observation_id":"94b42aef-7486-48b6-bb7f-14c9ac850ab1","resolution":{"observed_at":"2026-08-06T19:39:56.691206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:56.285127Z","title":"Motion-aware latent diffusion models for video frame interpolation","venue":null,"work_id":"ad6ede7f-131a-4289-a625-b067aa21f051","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.969835Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:349221e893411bcaa31f9a9d3984417b42f28feb6c7a31e0ca09eb26775096a9","observation_id":"4f4dd225-00f4-4af9-a2e4-795e9571c23e","resolution":{"observed_at":"2026-08-06T19:39:56.416485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:56.045610Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":"2fa1a550-1171-482d-a58e-8ce6bc1c11ae","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.065017Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:e60d0784b4fcd9e7cea522a528368dd6fbe4a4df9fcf75464a0afef6a5b64d4b","observation_id":"30b4f696-0981-4911-b0f1-cb203b475bc1","resolution":{"observed_at":"2026-08-06T19:39:56.153082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:55.835581Z","title":"High-resolution frame interpolation with patch-based cascaded diffusion","venue":null,"work_id":"283507c4-cd7b-4fe4-9b93-3ad21b05f771","year":2025},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.191430Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:aca148e3a9f32a4fc621aafbdde956f2cb9564cc34681f3531c233c7bf6b0678","observation_id":"8020d09a-c441-43dc-8f34-2fc5fdcdad6c","resolution":{"observed_at":"2026-08-06T19:39:55.944329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:55.586125Z","title":"Video interpolation with diffusion models","venue":null,"work_id":"dc0d70d8-0995-4513-8aac-2a56be207a53","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.271419Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:e1d51cec3ba45ed92cbfb436fe6bea21801cccc696810cbe8311eb0fce166632","observation_id":"05e0932e-f9ec-4e88-a8f3-ffbc77c7201f","resolution":{"observed_at":"2026-08-06T19:39:55.670110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:49.343570Z","title":"Musiq: Multi-scale image quality transformer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.343570Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:5deecb8a61acc3293b279bbcf5717bc5989bcdd51d2f35c79e57e14bdafa2c48","observation_id":"67ce6763-eed8-45ae-929f-e042d5d3a68b","resolution":{"observed_at":"2026-08-06T19:39:49.343570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17128","last_updated":"2024-03-25T19:13:12Z","snapshot_observed_at":"2026-08-07T02:33:44.368120Z","submitted_at":"2024-03-25T19:13:12Z","title":"Benchmarking Video Frame Interpolation","version":1},"cited_work":{"arxiv_id":"2403.17128","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.17128","snapshot_observed_at":"2026-08-06T19:39:52.705279Z","title":"Benchmarking Video Frame Interpolation","venue":"cs.CV","work_id":"0553669c-bb8f-412e-a439-06331f5cb87b","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.420635Z"},"links":{"cited_paper":"/paper/2403.17128","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:849bec3bac86fec9b86b8209eff2d66497757d2c84bbab01b25f2c15f5b233dc","observation_id":"877950b1-fa71-4ecf-949b-4b1e5d6d9ebd","resolution":{"observed_at":"2026-08-06T19:39:52.782107Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-06T19:39:49.522768Z","title":"Hunyuanvideo: A systematic framework for large video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.522768Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:da5cf004f7c4f1034cfd46a47af0674fec55e057ae514c21addfb54faf2d093d","observation_id":"2915c12b-3b44-42ab-b47c-a684c4bc59ee","resolution":{"observed_at":"2026-08-06T19:39:49.522768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:55.382637Z","title":"Amt: All-pairs multi-field transforms for efficient frame interpolation","venue":null,"work_id":"492d7edf-7989-42d9-819e-1d409cfa7260","year":2023},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.620605Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:59b3b1ee764ff83c9f3635c49f8f72ffbf1cd59088d7010981c880289c669887","observation_id":"db048b5a-f120-44b4-848d-03200bb276d1","resolution":{"observed_at":"2026-08-06T19:39:55.489251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00131","last_updated":"2024-11-28T14:07:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-28T14:07:45Z","title":"Open-Sora Plan: Open-Source Large Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00131","snapshot_observed_at":"2026-08-06T19:39:49.690405Z","title":"Open-sora plan: Open-source large video generation model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.690405Z"},"links":{"cited_paper":"/paper/2412.00131","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:aba0ac710527b817c5c25d40e353869e2c4593d51fa8c8a5da3b7a57133d85eb","observation_id":"3fbcd744-75a1-411c-879b-f6b83ff9fabc","resolution":{"observed_at":"2026-08-06T19:39:49.690405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:55.156999Z","title":"Video frame interpolation with transformer","venue":null,"work_id":"f2861cdd-7c45-411f-a213-d91bc6a94ae3","year":2022},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.781991Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:4dea8306b67871d5c1d9e03384c77ef4b93bd7160d2ef8a6ac9f2a4384804bd4","observation_id":"45319bac-716a-4ead-8dba-d6efbdc00223","resolution":{"observed_at":"2026-08-06T19:39:55.263744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:54.969370Z","title":null,"venue":null,"work_id":"cde9b672-7b5e-4a4e-9883-2fee0e9ddd63","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.872128Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:34e46237f8bda39f3af0404c3794d5a294f3eb427a84c07a5c849fa26249c31f","observation_id":"bd169093-2feb-479e-afd9-558b0bd9cd6a","resolution":{"observed_at":"2026-08-06T19:39:55.067543Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:54.752164Z","title":"Softmax splatting for video frame interpolation","venue":null,"work_id":"5e6b3e1d-0953-40b4-935c-d5235d6c2fd3","year":null},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.949172Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:94d404a197fa8fcdfa58f015322a5a4261787650e433db85c332687b5bf1aaba","observation_id":"b7411c03-cbd4-4744-98e0-f9ceb5e93315","resolution":{"observed_at":"2026-08-06T19:39:54.864863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:54.696163Z","title":"Video frame interpolation via adaptive convolution","venue":null,"work_id":"f5362959-fc4b-4525-b49a-4917467c9bdb","year":2017},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.020467Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:547569003f8f30e13a67768406d360a84bca0e34891be2e714a9e8f5b1ff6a73","observation_id":"ce1964e9-2575-4492-9e0f-edaf94b92cb0","resolution":{"observed_at":"2026-08-06T19:39:54.724111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:54.609855Z","title":"Video frame interpolation via adaptive separable convolution","venue":null,"work_id":"bf701602-0646-4752-af18-a16cbe238c6a","year":2017},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.098550Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:747b7e2eb74dc3aa1e4a7aaabd4b3c07d31731a1cd5c6c99c3ee64f46e8d8c62","observation_id":"17561dad-084a-4cc8-be45-94de769b0045","resolution":{"observed_at":"2026-08-06T19:39:54.653255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:54.507807Z","title":"Bmbc: Bilateral motion estimation with bilateral cost volume for video interpolation","venue":null,"work_id":"baf5a57f-d9a6-44c0-aa76-5672cbcd15fb","year":2020},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.174739Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:e5cb43ec5521388bb2a03e941e9c231c6948a4145f4e4993c4b92c1181dbedb2","observation_id":"d80aff71-de41-41d0-920a-eb6830ca7b12","resolution":{"observed_at":"2026-08-06T19:39:54.587693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:54.392513Z","title":"Video frame interpolation using real-time intermediate flow estimation","venue":null,"work_id":"a25cc9ce-20b0-408c-9b51-7d412d5dc5e2","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.249013Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:378c265f0aeaf3d07da2b7976186d7e67cb17a7e140d3712643de11d95a68348","observation_id":"d4fa605e-f612-4d12-a435-0aab14d43be1","resolution":{"observed_at":"2026-08-06T19:39:54.465193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:54.245404Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"a88d648c-bd1c-461f-86f3-c83b60fb07ed","year":2021},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.329157Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:7979ca5a10470025a38303ca34c1ed82ea673c27433720a82e829c29cfa927ef","observation_id":"1057529d-d3f4-4d1a-8851-4312629ffe84","resolution":{"observed_at":"2026-08-06T19:39:54.306407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:54.153059Z","title":"Film: Frame interpolation for large motion","venue":null,"work_id":"ff827d17-f313-4139-8bdd-0aba187b79aa","year":2022},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.409929Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:5c714238eb8f2967205700515f78ef71a60c1d6b6efe00a1fde26d19c27dea3f","observation_id":"732beea1-f9d5-461c-9a22-d2ef31908a2e","resolution":{"observed_at":"2026-08-06T19:39:54.198319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11365","last_updated":"2025-03-24T02:37:44Z","snapshot_observed_at":"2026-07-06T20:07:28.545657Z","submitted_at":"2024-12-16T01:37:51Z","title":"BiM-VFI: Bidirectional Motion Field-Guided Frame Interpolation for Video with Non-uniform Motions","version":4},"cited_work":{"arxiv_id":"2412.11365","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.11365","snapshot_observed_at":"2026-08-06T19:39:52.567259Z","title":"BiM-VFI: Bidirectional Motion Field-Guided Frame Interpolation for Video with Non-uniform Motions","venue":"cs.CV","work_id":"795698ba-4cb4-4aaa-b373-d96289c7cbdf","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.547820Z"},"links":{"cited_paper":"/paper/2412.11365","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:3c81686ae5f8d3607972e1dc863556a82417c1ef890fef9a9a866902361e3590","observation_id":"9af1bd22-cac1-43ac-bb7b-b4734d1980e2","resolution":{"observed_at":"2026-08-06T19:39:52.628540Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:54.052132Z","title":"Video frame interpolation transformer","venue":null,"work_id":"251e0c83-e281-44ff-98ee-d4f852f6535c","year":2022},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.675351Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:7040c1d3edc8b9074f2df68adeed71978eb7dfda7e552ddbeff76f7d2c951340","observation_id":"55db35de-f9e6-4f15-b8a4-77c057115512","resolution":{"observed_at":"2026-08-06T19:39:54.097210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:53.785976Z","title":"Forward and backward warping for optical flow-based frame interpolation","venue":null,"work_id":"3fd2f3a2-f48b-4419-9d1a-e20b9ac2a804","year":2022},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.770409Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:f506e1e1a28c8c577a496e51da1f9af2db90a14d63362f67fdefed7389874f23","observation_id":"f03c64af-5e60-4f4d-9e48-e01a63212130","resolution":{"observed_at":"2026-08-06T19:39:53.929854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-06T19:39:50.904060Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.904060Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:b7b55c78cdf247127061bcffc0318fc9422eebf256d98de90c09ade1999b4c17","observation_id":"ea2408bd-997a-4c0d-8102-7a5da4a92ada","resolution":{"observed_at":"2026-08-06T19:39:50.904060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:53.696010Z","title":"Adapool: Exponential adaptive pooling for information- retaining downsampling","venue":null,"work_id":"0daf111d-fc20-4770-baea-a03edac9b1fb","year":2022},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.972745Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:2fcdedf969909b2461eeb4d331675808742e322c81db1ae39fa243ff1a605924","observation_id":"7f0af36a-812c-47d0-8cb8-9f58d6baf807","resolution":{"observed_at":"2026-08-06T19:39:53.700048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:53.557911Z","title":"Raft: Recurrent all-pairs field transforms for optical flow","venue":null,"work_id":"2bc52757-f5d5-4c2b-9244-b1a739db8d35","year":2020},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.043340Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:cdc418c123bae8e3898dc38f38587ace107fbf7af520250d74cd632b64e1b82f","observation_id":"2328b2f7-a3d9-414c-85d7-b80898c6f816","resolution":{"observed_at":"2026-08-06T19:39:53.623787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:53.468695Z","title":"Video frame interpolation based on deformable kernel region","venue":null,"work_id":"a2129d05-3880-4478-b26a-dfbc0e4d6931","year":2022},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.109454Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:46ff7ac464eb49825ede9f4cde4303d3f31e16e492a7646d1cc53a3f3e3582a4","observation_id":"ab532a4c-dd34-468d-9327-1a962fe1f832","resolution":{"observed_at":"2026-08-06T19:39:53.517797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-06T19:39:51.210157Z","title":"Wan: Open and advanced large-scale video generative models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.210157Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:e9c1221b83f09c94e571704c9ae8c8aadb60c5165b484c9883c9d23b5786899f","observation_id":"93339fc7-2c0f-45ef-b1d2-d1d0a8886613","resolution":{"observed_at":"2026-08-06T19:39:51.210157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08260","last_updated":"2025-04-26T17:58:24Z","snapshot_observed_at":"2026-08-01T11:16:30.883699Z","submitted_at":"2024-10-10T17:57:49Z","title":"Koala-36M: A Large-scale Video Dataset Improving Consistency between Fine-grained Conditions and Video Content","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08260","snapshot_observed_at":"2026-08-06T19:39:51.302592Z","title":"Koala-36m: A large-scale video dataset improving con- sistency between fine-grained conditions and video content","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.302592Z"},"links":{"cited_paper":"/paper/2410.08260","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:b854bcaff915e5572ae2641b7a22c864c76329142785ea9c1706e40daf25509f","observation_id":"467bbe54-3760-42f4-b654-fd292d54415c","resolution":{"observed_at":"2026-08-06T19:39:51.302592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15239","last_updated":"2025-02-12T06:26:29Z","snapshot_observed_at":"2026-07-06T19:06:41.697671Z","submitted_at":"2024-08-27T17:57:14Z","title":"Generative Inbetweening: Adapting Image-to-Video Models for Keyframe Interpolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15239","snapshot_observed_at":"2026-08-06T19:39:51.414240Z","title":"Generative inbetweening: Adapting image-to-video models for keyframe interpolation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.414240Z"},"links":{"cited_paper":"/paper/2408.15239","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:bacf8ddc45077898f4089fdd7c209c5223130bbbb9f9a772d9a6ef64aec68075","observation_id":"04ff4419-5376-479d-97fc-d0a64e106fc8","resolution":{"observed_at":"2026-08-06T19:39:51.414240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06942","last_updated":"2024-01-04T05:00:34Z","snapshot_observed_at":"2026-07-06T15:53:46.393481Z","submitted_at":"2023-07-13T17:58:32Z","title":"InternVid: A Large-scale Video-Text Dataset for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06942","snapshot_observed_at":"2026-08-06T19:39:51.503054Z","title":"Internvid: A large-scale video-text dataset for multimodal understanding and generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.503054Z"},"links":{"cited_paper":"/paper/2307.06942","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:e457c04cdbe46c17ecb0a2bdbe1068c8a566e1f3fee6c3e85b3792ca507c917c","observation_id":"27f8fedf-7160-4197-ae13-899b34717564","resolution":{"observed_at":"2026-08-06T19:39:51.503054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03191","last_updated":"2022-12-07T12:20:55Z","snapshot_observed_at":"2026-07-06T14:27:34.639236Z","submitted_at":"2022-12-06T18:09:49Z","title":"InternVideo: General Video Foundation Models via Generative and Discriminative Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03191","snapshot_observed_at":"2026-08-06T19:39:51.612774Z","title":"Internvideo: General video foundation models via generative and discriminative learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.612774Z"},"links":{"cited_paper":"/paper/2212.03191","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:bee2e3e23b053aa28f3e2eebb10931d2ce7b826514b0b1fa4821aba3379adab4","observation_id":"0aefedc9-f462-4c9a-b3b2-8c3d5401cc01","resolution":{"observed_at":"2026-08-06T19:39:51.612774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:53.340178Z","title":"Zooming slow-mo: Fast and accurate one-stage space-time video super-resolution","venue":null,"work_id":"7886586f-389e-4b17-8abc-6f2710ee058d","year":2020},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.676316Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:2b48ca958a5aac74449b1c9de428341aced03292cae3e4915d5228edba3f214d","observation_id":"236d1690-7381-4e97-b8b1-b79d2421ac11","resolution":{"observed_at":"2026-08-06T19:39:53.403072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:53.244153Z","title":"Dynamicrafter: Animating open-domain images with video diffusion priors","venue":null,"work_id":"15159533-6400-4253-a51e-2bc1ccc0e6d6","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.794095Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:78a93bc1b63a63c3008ae632c0e7bef5ca0a2f03b7677e1df6f4459d6318a052","observation_id":"d35634ad-58c3-4e75-929c-0ae09b69c612","resolution":{"observed_at":"2026-08-06T19:39:53.298431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:53.129686Z","title":"Video enhancement with task-oriented flow","venue":null,"work_id":"1fa5202a-b3e7-4264-a6b2-5836f9de7720","year":2019},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.858890Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:662609fc5a0c738c041f052f69c7431744c27245a86655a689884bd8934b0e9a","observation_id":"939e1523-4f79-414c-9df4-d6588906cbe4","resolution":{"observed_at":"2026-08-06T19:39:53.163111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:53.013436Z","title":"Diffusion models: A comprehensive survey of methods and applications","venue":null,"work_id":"78079112-c7f0-4b0b-92c0-05d880bf7a68","year":2023},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.920067Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:b5da4a79407c9ad474ee950addc5397e2147d66c27b65e874760e4bfd5b4615c","observation_id":"36a2bede-64b2-4178-b147-b1360cb21b0f","resolution":{"observed_at":"2026-08-06T19:39:53.068601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05651","last_updated":"2025-03-01T07:27:28Z","snapshot_observed_at":"2026-08-02T23:31:23.105697Z","submitted_at":"2024-10-08T03:01:54Z","title":"ViBiDSampler: Enhancing Video Interpolation Using Bidirectional Diffusion Sampler","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05651","snapshot_observed_at":"2026-08-06T19:39:51.984592Z","title":"Vibidsampler: Enhancing video interpolation using bidirectional diffusion sampler","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.984592Z"},"links":{"cited_paper":"/paper/2410.05651","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:cc769b2dc7f7b4290dfed7bcca0fcfb46fc3c11e817ab631f080f526ad20ad6b","observation_id":"a1054194-8832-4458-8b56-4edb510eee93","resolution":{"observed_at":"2026-08-06T19:39:51.984592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-06T19:39:52.089841Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:52.089841Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:1f04fa2b3ac6115b196d6f3220a80516648c465eabf21daffe72da47de7a94e1","observation_id":"35e710bb-20aa-4533-b75e-4975d8c4cdec","resolution":{"observed_at":"2026-08-06T19:39:52.089841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:52.889724Z","title":"Extracting motion and appearance via inter-frame attention for efficient video frame interpola- tion","venue":null,"work_id":"118f14bb-5901-4343-af1f-c0dca4a5677b","year":2023},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:52.186101Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:92fb435a55e64dea9b9e4e2e878746e88435b0efbe9040900205d1a9f5f9322d","observation_id":"4aae5b3e-4f67-40b4-93ae-12d96e4d76aa","resolution":{"observed_at":"2026-08-06T19:39:52.924906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11755","last_updated":"2024-12-16T13:19:41Z","snapshot_observed_at":"2026-08-08T12:19:36.325543Z","submitted_at":"2024-12-16T13:19:41Z","title":"Generative Inbetweening through Frame-wise Conditions-Driven Video Generation","version":1},"cited_work":{"arxiv_id":"2412.11755","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.11755","snapshot_observed_at":"2026-08-06T19:39:52.377581Z","title":"Generative Inbetweening through Frame-wise Conditions-Driven Video Generation","venue":"cs.CV","work_id":"afb5f73c-87ed-4bb7-a0ab-22e837d70330","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:52.269953Z"},"links":{"cited_paper":"/paper/2412.11755","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:0c0b878b061d47f3ea7966c1d9bbd36f11b541e295a26fb5268b291b93f8829f","observation_id":"5a7f2291-769f-400e-8f94-10e9f6ca71ca","resolution":{"observed_at":"2026-08-06T19:39:52.433183Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T15:18:23.907787Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":3,"verified_fuzzy":33},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 1 inbound Pith citation observation for arXiv:2507.05173."}