{"as_of":"2026-08-09T10:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4b9d126f165ef1b51f2911cbb9f7a55c42520150b907bd97d9a475ef202fb20d","coverage":[{"denominator":86,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":86,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T08:21:50.176074Z","state":"measured"},{"denominator":86,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":86,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.06173/citation-record","integrity":"/paper/2607.06173/integrity","json":"/paper/2607.06173/citation-record.json","paper":"/paper/2607.06173"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:42.373506Z","title":"InICLR, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:42.373506Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:d8850a9bff6d437ed4d6170ea901ba46a834a68ab0f24353da548f58e541e8e3","observation_id":"0665dd74-9a36-4f68-82f0-8e3ec53f0d3f","resolution":{"observed_at":"2026-08-02T08:21:42.373506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:42.433382Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:42.433382Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:a054cefc62e33f88e7eff7a98a40330bf9dcdc8dea59dc278497d8825b3c9bab","observation_id":"83000d4c-0299-4422-9f21-25adf2816fb6","resolution":{"observed_at":"2026-08-02T08:21:42.433382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-02T08:21:42.607792Z","title":"Hunyuanvideo: A systematic framework for large video generative models.arXiv preprint arXiv:2412.03603, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:42.607792Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:9a0f99f77f217f003e434cba558d2552490f0390239704315bf67946756b1708","observation_id":"56b5f97e-e07f-47f9-9f4a-600f90e82440","resolution":{"observed_at":"2026-08-02T08:21:42.607792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:42.761616Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:42.761616Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:6ef7179b4a95cdaa83d5137fdf00c1258248951e2900007083f953a6b87598a2","observation_id":"e19a6d29-3ef8-4d3c-a132-7e3238ea37b5","resolution":{"observed_at":"2026-08-02T08:21:42.761616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-02T08:21:42.849671Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:42.849671Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:408c26bc103bbe6e87ee5a1b6ae910fa3a9639dbb39d2c97e45076c14a65592c","observation_id":"b64368e7-2503-42e9-aa5a-210f8c96651d","resolution":{"observed_at":"2026-08-02T08:21:42.849671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.15911","last_updated":"2026-04-17T10:11:39Z","snapshot_observed_at":"2026-07-06T23:03:21.422544Z","submitted_at":"2026-04-17T10:11:39Z","title":"Efficient Video Diffusion Models: Advancements and Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.15911","snapshot_observed_at":"2026-08-02T08:21:42.964207Z","title":"Efficient video diffusion models: Advancements and challenges.arXiv preprint arXiv:2604.15911, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:42.964207Z"},"links":{"cited_paper":"/paper/2604.15911","citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:c2fb943a2034a906a8dc14b7116f3ae6ee5b3aff8ab4958e6f5f3d129714b89c","observation_id":"c1bb6a8d-a37d-4065-9b0e-01ac40fccbad","resolution":{"observed_at":"2026-08-02T08:21:42.964207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:43.068527Z","title":"Moalign: Motion-centric representation alignment for video diffusion models.arXiv preprint arXiv:2510.19022, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:43.068527Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:8cc5a1e3da4e85fef215daba6585b8973e72bf6c766fccab79c101879888f4b0","observation_id":"b8b0dbe1-bc09-47bf-ab64-c809dd43a7f3","resolution":{"observed_at":"2026-08-02T08:21:43.068527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.25427","last_updated":"2026-04-28T09:34:51Z","snapshot_observed_at":"2026-07-06T23:11:16.247497Z","submitted_at":"2026-04-28T09:34:51Z","title":"A Systematic Post-Train Framework for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.25427","snapshot_observed_at":"2026-08-02T08:21:43.194828Z","title":"A systematic post-train framework for video generation.arXiv preprint arXiv:2604.25427, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:43.194828Z"},"links":{"cited_paper":"/paper/2604.25427","citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:ddf2da8418b2c10f3c2dbb448670b67968fa60eb4259ee60556a25e79250fd4b","observation_id":"329de75c-2e64-409b-86ad-fe1e2eb22bbe","resolution":{"observed_at":"2026-08-02T08:21:43.194828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:43.311128Z","title":"Mobile-oriented video diffusion: Enabling text-to-video generation on mobile devices without retraining, compression, or pruning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:43.311128Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:c4edb69c352bbd11231c0fa83cf3caec430e11cea34b9bb465f71a7f6596d630","observation_id":"a66d33af-1f81-4ef0-8fbd-1c72abcbb54e","resolution":{"observed_at":"2026-08-02T08:21:43.311128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:43.343768Z","title":"Tamingdiffusiontransformer for real-time mobile video generation.arXiv preprint arXiv:2507.13343, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:43.343768Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:4555f53755e91d6fe160934ccc38d6f67ff6bbe9ee7193718df405cd1904e8e3","observation_id":"62c4e14f-5f44-4f6b-83a2-085791d9ccb0","resolution":{"observed_at":"2026-08-02T08:21:43.343768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:43.378695Z","title":"S2dit: Sandwichdiffusiontransformerformobilestreaming video generation.arXiv preprint arXiv:2601.12719, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:43.378695Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:f30f3434dfb51a1ad26012b8c9aba6f1fa4213380e2a98406dbb56361f60b8aa","observation_id":"9d64e9b7-858d-4eec-bc0e-28b2de3a3fe7","resolution":{"observed_at":"2026-08-02T08:21:43.378695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:43.407500Z","title":"Mobile video diffusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:43.407500Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:963e69f1114b9c45ee5248ab0f5241211c990417ee67c263b475fa29065f297e","observation_id":"200ea078-6346-4511-a56c-bebbd434e54a","resolution":{"observed_at":"2026-08-02T08:21:43.407500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:43.471979Z","title":"Snapgen-v: Generating a five-second video within five seconds on a mobile device","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:43.471979Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:99ee61c151865396810033f85ba94075ce78120e1630158721bbfe672e479159","observation_id":"ae2a47d7-3cd2-4b42-965a-48382f2dedc5","resolution":{"observed_at":"2026-08-02T08:21:43.471979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:43.618686Z","title":"Sana-video: Efficient video generation with block linear diffusion transformer","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:43.618686Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:1a1d955fac89fed7ab10c6ec0a583f10821f04da13a9bdd52d83b8475c9fe560","observation_id":"10ad7b12-a8f0-49a7-bbf7-d283b8a0cc85","resolution":{"observed_at":"2026-08-02T08:21:43.618686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:43.735309Z","title":"Attention surgery: An efficient recipe to linearize your video diffusion transformer","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:43.735309Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:70a3ef91a675718b9f7fd350e423a2181f3b66c23eb783fe4472dfbc06a017c0","observation_id":"83872c8b-05ba-4e65-9a27-3e4e0afa0092","resolution":{"observed_at":"2026-08-02T08:21:43.735309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:43.831980Z","title":"Rehyat: Recurrent hybrid attention for video diffusion transformers","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:43.831980Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:84bd94d64ac63499b621a0fbe061fafc2bd5178e09c0b8eecdcf8c99c7919eab","observation_id":"8c41ed9e-8110-43c0-a5a1-0b325df28a87","resolution":{"observed_at":"2026-08-02T08:21:43.831980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06578","last_updated":"2024-12-09T15:30:09Z","snapshot_observed_at":"2026-08-08T17:16:08.719323Z","submitted_at":"2024-12-09T15:30:09Z","title":"MoViE: Mobile Diffusion for Video Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06578","snapshot_observed_at":"2026-08-02T08:21:43.991715Z","title":"Movie: Mobile diffusion for video editing.arXiv preprint arXiv:2412.06578, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:43.991715Z"},"links":{"cited_paper":"/paper/2412.06578","citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:7552a0cf7cb290fa83d5e40895b47ea0c5592726e4bd73dfdec90401e89fe0fb","observation_id":"41222ae2-c9b0-4745-bf05-c5803cd5d191","resolution":{"observed_at":"2026-08-02T08:21:43.991715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:44.069600Z","title":"Clockwork diffusion: Efficient generation with model-step distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:44.069600Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:e32a7387f8ed45358dd20b830a0fde5cc551604e53cfd68bb11a53833685fe4a","observation_id":"2945076f-930a-4104-ac06-ef6db7f7fac0","resolution":{"observed_at":"2026-08-02T08:21:44.069600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:44.239356Z","title":"Amd-hummingbird: Towards an efficient text-to-video model.arXiv preprint arXiv:2503.18559, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:44.239356Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:6990bc7d2b2a0b4ac3107ca90a5d2d49da2f854fa4a0726b4664230a34081cf0","observation_id":"7f33ebbc-33da-48c5-acba-a2739fbf7f03","resolution":{"observed_at":"2026-08-02T08:21:44.239356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:44.395828Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:44.395828Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:1969e73b4fc7ec49475332a610bf549f357239bb2ab3ecade97f2273e9428c50","observation_id":"c77e72b4-ffbd-437c-b03f-e349d0404ac4","resolution":{"observed_at":"2026-08-02T08:21:44.395828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04363","last_updated":"2025-03-31T07:22:14Z","snapshot_observed_at":"2026-08-09T10:39:06.436714Z","submitted_at":"2025-02-05T05:42:29Z","title":"On-device Sora: Enabling Training-Free Diffusion-based Text-to-Video Generation for Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04363","snapshot_observed_at":"2026-08-02T08:21:44.482775Z","title":"On-device sora: Enabling training-free diffusion-based text-to-video generation for mobile devices.arXiv preprint arXiv:2502.04363, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:44.482775Z"},"links":{"cited_paper":"/paper/2502.04363","citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:582e0bb261c2dab592e45fa4a4f7ba4919ab655eac1b19bc10339dca4eac5417","observation_id":"28edac6e-cc20-40fd-9a52-b3ee690f6fbd","resolution":{"observed_at":"2026-08-02T08:21:44.482775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:44.579584Z","title":"SANA 1.5: Efficient scaling of training-time and inference-time compute in linear diffusion transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:44.579584Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:2c39c06d1619d1b83f5f0d3980b82eec1c4f13a33602cf9a81ec2201ec4b2709","observation_id":"12a83501-4239-4b27-83a0-a050ed05312e","resolution":{"observed_at":"2026-08-02T08:21:44.579584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:44.664824Z","title":"FastLightGen: Fast and light video generation with fewer steps and parameters","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:44.664824Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:7503f945d208008f86cc0d7becf402f831f723867f608e807267070c3df406d6","observation_id":"03f24a78-e79d-40ef-b751-d55d4644aee9","resolution":{"observed_at":"2026-08-02T08:21:44.664824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:44.781656Z","title":"Hadzic, Manling Li, AgrimGupta,StefanoMassaroli,AzaliaMirhoseini,JuanCarlosNiebles,StefanoErmon,andLiFei-Fei","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:44.781656Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:9d25f396a80a7b9219b0e53e0e9f970554379fc98e55731e2977429e8bb51799","observation_id":"8cc07399-c155-4ecb-8c8c-2999ae66ac29","resolution":{"observed_at":"2026-08-02T08:21:44.781656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:44.903531Z","title":"Freeman, and Taesung Park","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:44.903531Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:8dd20cf0fa9dac0401c60474e73b30c154b7018d4f8c67472c7d7166d7419c33","observation_id":"6bf77c7b-9a36-4be9-bf29-2009f876e8b3","resolution":{"observed_at":"2026-08-02T08:21:44.903531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:45.070933Z","title":"Classifier-Free Diffusion Guidance","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:45.070933Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:48aa3078addf9352b5cf596249f53dbc7bb8b64e2eb5e1fd72b9d726ab59dff5","observation_id":"36e77ffd-78d1-4460-bc10-8c1c1423bc1d","resolution":{"observed_at":"2026-08-02T08:21:45.070933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:45.170210Z","title":"Decoupled DMD: CFG augmentation as the spear, distribution matching as the shield","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:45.170210Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:089a872491b2f1b6d43470dcddc231f9b7bd3defc1ff2624aeb5396607bdb5c8","observation_id":"e9479b95-a838-4f2b-bc25-37c03f4e374e","resolution":{"observed_at":"2026-08-02T08:21:45.170210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:45.376561Z","title":"Barron, and Ben Mildenhall","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:45.376561Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:71006cdd2ad7f467c319e2ac88629a7345f24c2f577df2f85661c202692fec0a","observation_id":"2ab4b322-6347-43e0-ae9d-3589fed12c9a","resolution":{"observed_at":"2026-08-02T08:21:45.376561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:45.508798Z","title":"Jacobs, Alexei A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:45.508798Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:64e9720f2a7072e54a5ec32c90461b79131850af411bbf6aa32d66ffc98af121","observation_id":"c141a6ff-0ae5-4f5b-8e05-b154f7be9d84","resolution":{"observed_at":"2026-08-02T08:21:45.508798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:45.637117Z","title":"Compositional visual generation with energy based models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:45.637117Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:97d899f3e9e97218429707aed83a7e4db6bd41ef14606507b2c28170bd4c6212","observation_id":"7e536701-efda-4270-8828-2845afc3a97d","resolution":{"observed_at":"2026-08-02T08:21:45.637117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:45.755415Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:45.755415Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:a588de9ce35d5838a129e16897c4fa733ebfabbe8a8d5caba62ef5a2a4f15647","observation_id":"75520106-f25e-4328-a66a-4da674b0534a","resolution":{"observed_at":"2026-08-02T08:21:45.755415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:45.890163Z","title":"Faster video diffusion with trainable sparse attention","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:45.890163Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:444ef67106f3042195b25cb237ef27965494187d5f8ad947cefd3987d6a7c84e","observation_id":"63afad3a-441d-43d7-a8a4-3579a1aa6234","resolution":{"observed_at":"2026-08-02T08:21:45.890163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:46.045901Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:46.045901Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:612413836f27ea6eb42226f24fccc9b1f9ca3cd9292d03d71fea5e3ff25247fd","observation_id":"5b13600d-0b8e-44ab-83a4-80c44de019e3","resolution":{"observed_at":"2026-08-02T08:21:46.045901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:46.141366Z","title":"Nvidia fastgen: Fast generation from diffusion models, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:46.141366Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:9d407b0753b3c674058670412f89378b716bef41097f2b41f7dcbdc5b6f70ab5","observation_id":"bd880515-8111-4f02-8d9b-800108660d4c","resolution":{"observed_at":"2026-08-02T08:21:46.141366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:46.237394Z","title":"Lightx2v: Light video generation inference framework.https://github","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:46.237394Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:76ea40ce7fcf823834ccab6794446ab33f6c70c5ec375aae5dd354f8d44f0988","observation_id":"f3754048-2bd2-4f90-bb7c-12c5c315ba85","resolution":{"observed_at":"2026-08-02T08:21:46.237394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:46.403284Z","title":"https://github.com/madebyollin/ taehv, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:46.403284Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:01e53b524b48e89c3e77328007891636b36e24c0072e472e6256fa58cea523ed","observation_id":"52b4da6b-3b5d-4bfb-8c22-39a2a12d65f9","resolution":{"observed_at":"2026-08-02T08:21:46.403284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:46.550681Z","title":"Abenchmark dataset and evaluation methodology for video object segmentation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:46.550681Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:e99fbb1610ec9699bd86826474a9bb905f9ba5b7b0526f29be51191449c8f1ec","observation_id":"e1007310-c2f6-4b11-be91-246cb1f4faac","resolution":{"observed_at":"2026-08-02T08:21:46.550681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.00557","last_updated":"2018-03-27T10:02:26Z","snapshot_observed_at":"2026-07-06T06:26:10.399472Z","submitted_at":"2018-03-01T18:56:36Z","title":"The 2018 DAVIS Challenge on Video Object Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.00557","snapshot_observed_at":"2026-08-02T08:21:46.704213Z","title":"The 2018 davis challenge on video object segmentation.arXiv:1803.00557, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:46.704213Z"},"links":{"cited_paper":"/paper/1803.00557","citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:6e1ab407ef1360831727160c49873c62ce7590d8a4a96097cad94892d6e2d4ea","observation_id":"cac7b691-cd6c-4f62-8b97-9c64b0d3711c","resolution":{"observed_at":"2026-08-02T08:21:46.704213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:46.961784Z","title":"VBench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:46.961784Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:05660550aed84812b7254e43ba6876d58176678412f38585e3d95bce326155c8","observation_id":"f1660d8c-dd6f-4733-ade8-87c522b109f6","resolution":{"observed_at":"2026-08-02T08:21:46.961784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:47.076121Z","title":"Fastforward: Neural network quantization for research and prototyping","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:47.076121Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:3412195a14abe8edd1e98a834a7478d4016ed16a4443094f9ed97abd2a008efe","observation_id":"d96ad724-1b77-4b9d-a8ca-c43a3971daf2","resolution":{"observed_at":"2026-08-02T08:21:47.076121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00131","last_updated":"2024-11-28T14:07:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-28T14:07:45Z","title":"Open-Sora Plan: Open-Source Large Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00131","snapshot_observed_at":"2026-08-02T08:21:47.178949Z","title":"Open-sora plan: Open-source large video generation model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:47.178949Z"},"links":{"cited_paper":"/paper/2412.00131","citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:f392e96b264bbf21ad71b6831fe025cf865e9636783068616109bb9306e41ed1","observation_id":"717b6340-37b6-40f5-8f41-4c2c4397acae","resolution":{"observed_at":"2026-08-02T08:21:47.178949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-02T08:21:47.256075Z","title":"Open-sora: Democratizing efficient video production for all.arXiv preprint arXiv:2412.20404, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:47.256075Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:901e516ce90262a0be52de931a0f52f305444af99f7db529b05df1fa5d574f72","observation_id":"15d01596-1caa-4748-8e61-e0ada1bb6a3e","resolution":{"observed_at":"2026-08-02T08:21:47.256075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-02T08:21:47.395667Z","title":"Ltx-video: Realtime video latent diffusion.arXiv preprint arXiv:2501.00103, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:47.395667Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:1302080b5e34f6e2371e72e7c4a9698fcbe62469e90f5e275a036a5a7a3f3f96","observation_id":"f663fc7e-f958-4037-889d-c75f2ee01e2c","resolution":{"observed_at":"2026-08-02T08:21:47.395667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:47.456145Z","title":"Pyramidal flow matching for efficient video generative modeling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:47.456145Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:ca2282563e107fed172d47b5e739fed91e674c3c04359ccf5c032350d6c26c6a","observation_id":"c0193c03-4d62-4bea-bfd3-c68e9c0fd49a","resolution":{"observed_at":"2026-08-02T08:21:47.456145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10915","last_updated":"2026-07-10T04:56:00Z","snapshot_observed_at":"2026-08-09T05:08:57.326158Z","submitted_at":"2025-06-12T17:29:40Z","title":"M4V: Multimodal Mamba for Efficient Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10915","snapshot_observed_at":"2026-08-02T08:21:47.529772Z","title":"M4v: Multi-modal mamba for text-to-video generation.arXiv preprint arXiv:2506.10915, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:47.529772Z"},"links":{"cited_paper":"/paper/2506.10915","citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:806387cfbf6d6f63a9036af0bc72178fc74b6adcd0d3771d75fe1d11a0aa92fe","observation_id":"a0e029a5-6f1e-44f4-881e-082c12d34802","resolution":{"observed_at":"2026-08-02T08:21:47.529772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:47.596923Z","title":"Fast video generation with sliding tile attention","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:47.596923Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:0a9c99d89cfd57a51293ff05c3dd90172c48172d6a0eb82aa007db9637cbfd40","observation_id":"9178de47-31b3-46f5-8d09-ac9f11859376","resolution":{"observed_at":"2026-08-02T08:21:47.596923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:47.673235Z","title":"Tinyfusion: Diffusion transformers learned shallow","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:47.673235Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:4acc2dc38cf2257c5d0770d77c1ba57adbb5ea5a5b754cc7cdb5537b148586d2","observation_id":"d0093cfa-ae8b-4960-a083-9a1f7b9fa08f","resolution":{"observed_at":"2026-08-02T08:21:47.673235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:47.783195Z","title":"Learnable sparsity for vision generative models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:47.783195Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:836e9b1f4fdaf0f5a080fa2affe4463a426dea99507c1803485d30a78fb1af89","observation_id":"895c4d68-5510-4889-b087-bcefb0f74013","resolution":{"observed_at":"2026-08-02T08:21:47.783195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:47.888725Z","title":"OBS-diff: Accurate pruning for diffusion models in one-shot","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:47.888725Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:480f863b14c9f68e0a82126039547f103182caf7ccbf03a8e6d087fe41f75794","observation_id":"213050b8-77ea-48bd-a201-f03b98fd6e0e","resolution":{"observed_at":"2026-08-02T08:21:47.888725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:47.999897Z","title":"Generating long sequences with sparse transformers, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:47.999897Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:cbff4f82b5180ef2b49f79cb19ab3b86ded705cdace1987c7d412dc1e84ac4b5","observation_id":"2d82b61d-5f11-4516-8166-d05b3d864973","resolution":{"observed_at":"2026-08-02T08:21:47.999897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:48.089461Z","title":"Peters, and Arman Cohan","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:48.089461Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:33b7c77e8b41c4163a6439e6cf7fb4256a934b7ea7b27c66e71ab686f86a1621","observation_id":"e8c13547-a651-4c66-a64f-d4b6a99ae267","resolution":{"observed_at":"2026-08-02T08:21:48.089461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:48.195577Z","title":"Bigbird: Transformers for longer sequences","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:48.195577Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:bd0f150e04cb0dfd1fec543e26e40ae7862ea22de57fc6a6e7d8427a6477d575","observation_id":"ee7cb08b-764b-4645-8c95-8517b67b7a8f","resolution":{"observed_at":"2026-08-02T08:21:48.195577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:48.254528Z","title":"Efficient content-based sparse attention with routing transformers.Transactions of the Association for Computational Linguistics, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:48.254528Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:4857c9a9a2e47bc6600179cd96da32fa24ce10a9d36c6531031dcad226eb5cda","observation_id":"7add25e1-0049-4df2-b56b-39e214cb040d","resolution":{"observed_at":"2026-08-02T08:21:48.254528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:48.389814Z","title":"Object-centric diffusion for efficient video editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:48.389814Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:c0d67c2165f67fe5064f0bce43a9212575eb2865201c32d5606e9b42782682f6","observation_id":"4f7b4d4d-1f2e-434b-8794-2a34313f336e","resolution":{"observed_at":"2026-08-02T08:21:48.389814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:48.435544Z","title":"Li, Madian Khabsa, Han Fang, and Hao Ma","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:48.435544Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:50dc0da0d6584ba4cacad22dc7e99152f866d0676fbc5f1fe4982fcfdd630508","observation_id":"f83acb98-93e9-42a8-8751-9fadda3b57a2","resolution":{"observed_at":"2026-08-02T08:21:48.435544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:48.502184Z","title":"Reformer: The efficient transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:48.502184Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:3452c54286746487ba7d48640c80f66c757a146fd7d652de630307315b3c2bb7","observation_id":"74345b2e-bc12-457c-b947-7395511620c8","resolution":{"observed_at":"2026-08-02T08:21:48.502184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:48.616499Z","title":"Transformers are rnns: fast autoregressive transformers with linear attention","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:48.616499Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:dc809f0b6c8c5b5748a2fcb433b297fb0857c2bac0bb3dd466bbeda158c2ec76","observation_id":"e37b488a-8504-481f-9884-e318fbfb8f72","resolution":{"observed_at":"2026-08-02T08:21:48.616499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:48.730873Z","title":"Rethinking attention with performers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:48.730873Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:1b07437727e3215234a2eb83cbe1555a2e011e2b25ef935e74ec5b3c55ba0bb2","observation_id":"621ec1a0-61ff-4575-a854-8d7fa16e2e92","resolution":{"observed_at":"2026-08-02T08:21:48.730873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:48.874547Z","title":"Nyströmformer: A nyström-based algorithm for approximating self-attention","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:48.874547Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:3b4b5425679f22fdf7fa248c6c01a8eec113ed9ecaf7ae62264889895099090b","observation_id":"9fcbf503-79ae-4cdf-8829-71ae2ee8eda9","resolution":{"observed_at":"2026-08-02T08:21:48.874547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:48.984639Z","title":"Flashattention: Fast and memory-efficient exact attention with IO-awareness","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:48.984639Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:d0cf08f38dd6097e25b65bb4989f68f37edb9f8076c9f7971a5b00184db4ce0e","observation_id":"6733f197-370d-4e9c-8fd8-88ca2237714d","resolution":{"observed_at":"2026-08-02T08:21:48.984639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:49.048638Z","title":"Flashattention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:49.048638Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:5805370551d85b273ba2c00fa72fa4f4b15351eda6b3e64d0cebceb0daae9a93","observation_id":"21105a20-cfb1-4887-b021-2564722ccb9f","resolution":{"observed_at":"2026-08-02T08:21:49.048638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:49.183611Z","title":"HLA:HadamardLinear Attention, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:49.183611Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:d803ca5769a8703e0ca216a99800879cee0fd6d868381965431802040e1b4f3a","observation_id":"8c669b83-e667-44be-b956-8d57c750d110","resolution":{"observed_at":"2026-08-02T08:21:49.183611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:49.343265Z","title":"Gonzalez, Jianfei Chen, and Jun Zhu","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:49.343265Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:6317eec814e72c1211063e1f84f74b447c4cc278788eacbcd766abf61c4898bb","observation_id":"10008844-d1ac-4460-9728-21a1255f4c0f","resolution":{"observed_at":"2026-08-02T08:21:49.343265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:49.489047Z","title":"Liteattention: A temporal sparse attention for diffusion transformers, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:49.489047Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:da784e8a64fed1ae5ccdd1367f86e5e9dfffff89ee86511c1973e91e5e571090","observation_id":"2ad55bbe-251e-4430-8b58-ffd66485bb6c","resolution":{"observed_at":"2026-08-02T08:21:49.489047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:49.585118Z","title":"Adaptor: Adaptive token reduction for video diffusion transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:49.585118Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:716960b3b0a942b3fb15dd0603bddc7ed7fe5a73d23a41e1f9c090c69cb00d5a","observation_id":"9cdefb9a-1204-408e-a774-4c09df607f78","resolution":{"observed_at":"2026-08-02T08:21:49.585118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:49.676883Z","title":"Astraea: A token-wise acceleration framework for video diffusion transformers","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:49.676883Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:c3462ce60cbe43151dea074ef8e16790efa99b07b2b16cac9c9cdc0617d1fe94","observation_id":"fcc849a4-9aeb-4aa4-bc0f-17182650aa79","resolution":{"observed_at":"2026-08-02T08:21:49.676883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:49.776506Z","title":"TPDiff: Temporal pyramid video diffusion model","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:49.776506Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:4463da27fbdc81b230463a5482deafd2c1bb3c6edb876c9c7d03d9c24a3659ed","observation_id":"f3091fbb-4930-4616-aa1a-970ff59818ca","resolution":{"observed_at":"2026-08-02T08:21:49.776506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:49.977802Z","title":"PyramidalWan: On making pretrained video model pyramidal for efficient inference","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:49.977802Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:daf2dcf0bb3360cf71fa00fcba64b7a7340927131ca05198ea855080e4344263","observation_id":"419ae7e7-3235-4804-b14f-8455ee8b9189","resolution":{"observed_at":"2026-08-02T08:21:49.977802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:50.108254Z","title":"Fast high-resolution image synthesis with latent adversarial diffusion distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:50.108254Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:1196adcb1ea1ec5b52d1f6f4efff7349c537534b4695a71f953e677749584463","observation_id":"a2ca59ec-a324-4b23-ac28-59ab87993b94","resolution":{"observed_at":"2026-08-02T08:21:50.108254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:50.112167Z","title":"Align your flow: Scaling continuous-time flow map distillation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:50.112167Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:a420a97a334f1f5aee709fae8ce49f733abea29510bb09f3c3f4c973aeec500c","observation_id":"746a97f2-ffbe-40ac-b7b8-3c2d3aaf9e5b","resolution":{"observed_at":"2026-08-02T08:21:50.112167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:50.115963Z","title":"Sana-sprint: One-step diffusion with continuous-time consistency distillation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:50.115963Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:790378dc6032e16c4446254dfc0440fb330ea35974e047bde4992c8cb2fb127f","observation_id":"afff3e65-0637-49e6-8843-30302922a7a6","resolution":{"observed_at":"2026-08-02T08:21:50.115963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:50.120597Z","title":"Twinflow: Realizing one-step generation on large models with self-adversarial flows","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:50.120597Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:0fb1285c1e0c298138abf6f63c13cd61c349e60499e78b8fb9c66ab06987d202","observation_id":"2f384f97-88ea-4529-b0c9-1bc9adbf0c53","resolution":{"observed_at":"2026-08-02T08:21:50.120597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:50.124480Z","title":"Metaxas, Sergey Tulyakov, and Jian Ren","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:50.124480Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:a91527d7d91c20438b1a260e250272c212727c50dbf43d3285fcad559185e16f","observation_id":"63eeaf85-85e2-4820-b70b-64f91e2b6ec1","resolution":{"observed_at":"2026-08-02T08:21:50.124480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:50.128458Z","title":"Diffusion adversarial post-training for one-step video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:50.128458Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:a90fc10f717d6da2f25b8b4652fcc52cb75114ee61b2c9ac12332ea07e2363af","observation_id":"32b42b70-542d-46a6-a358-63fdb248e063","resolution":{"observed_at":"2026-08-02T08:21:50.128458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:50.132158Z","title":"Diff-Instruct: A Universal Approach for Transferring Knowledge From Pre-trained Diffusion Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:50.132158Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:a50f7dc1c0ddcf03d43fad6802c269e11a1a36b75b8ecc6057578a0f07d1e9e0","observation_id":"26c233d2-db87-427b-b0f5-f444462b1afb","resolution":{"observed_at":"2026-08-02T08:21:50.132158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:50.136768Z","title":"Phaseddmd: Few-stepdistributionmatchingdistillationviascorematching within subintervals, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:50.136768Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:0f0d1a91299da84772d3fad15d5a8e04edb56cd87bb4cfa463a7e372b071329a","observation_id":"5c8da603-62b1-435c-9a23-1c50cfcdb00d","resolution":{"observed_at":"2026-08-02T08:21:50.136768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:50.140600Z","title":"MagicDistillation: Weak-to-strong video distillation for large-scale few-step synthesis, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:50.140600Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:a165be58ce42b8290f833b70b71997446afad67bde019791aedd54d2cd180d21","observation_id":"8704d43a-1e2e-4f96-a6b0-f1ab322eb20e","resolution":{"observed_at":"2026-08-02T08:21:50.140600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:50.144534Z","title":"Transition matching distillation for fast video generation, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:50.144534Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:0df920664d139f89937d477cb186713f73d8bb2b0ae357f85c975f331ec242da","observation_id":"eb4ab00e-4d25-461e-8567-c8b2da711457","resolution":{"observed_at":"2026-08-02T08:21:50.144534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:50.148170Z","title":"HiStream: Efficient high-resolution video generation via redundancy-eliminated streaming, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:50.148170Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:bdfeadb89cdfac5913e527c81cb6bc43aa565f96290809eec4960e09f336a056","observation_id":"a45c92bb-cffa-4cef-9630-6ee949c24d9c","resolution":{"observed_at":"2026-08-02T08:21:50.148170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:50.152094Z","title":"Large scale diffusion distillation via score-regularized continuous-time consistency","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:50.152094Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:8740092c1499644391a11c4b1ea677a257d5309e472e565612d07030156f5a5e","observation_id":"ab4308f2-105f-4161-b820-e4a4c3a22eb1","resolution":{"observed_at":"2026-08-02T08:21:50.152094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:50.156049Z","title":"Cosmos world foundation model platform for physical ai, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:50.156049Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:4d42ddb305a25676e4c835a695c6964d8f71f89127b0b66a4e54eb4564683c88","observation_id":"4d5a3b0d-8da9-475d-90f3-1f0dd436d42d","resolution":{"observed_at":"2026-08-02T08:21:50.156049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:50.159833Z","title":"Leanvae: An ultra-efficient reconstruction vae for video diffusion models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:50.159833Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:50909fd27355015b32d6ce3d007c7807d545260c15ac619a576322be47a0ea23","observation_id":"b7d20e67-52dd-4e3d-bb90-f634afb71444","resolution":{"observed_at":"2026-08-02T08:21:50.159833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:50.163653Z","title":"WF-VAE: Enhancing video vae by wavelet-driven energy flow for latent video diffusion model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:50.163653Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:eec22473b4d3dc463a0f300840c5c05a2ff41948d4c0865eeaf0d3cb38749bb1","observation_id":"cd9d7904-7a15-4d0b-ac30-c9880b53610e","resolution":{"observed_at":"2026-08-02T08:21:50.163653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:50.168114Z","title":"Improved video vae for latent video diffusion model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:50.168114Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:fa91498c0fea826eaa26d8f3609f916c1f827767cf404e92564e3f7c6622989c","observation_id":"77514c81-80eb-4b56-9621-4e4cc0b995bd","resolution":{"observed_at":"2026-08-02T08:21:50.168114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:50.172241Z","title":"Turbo-vaed: Fast and stable transfer of video-vaes to mobile devices","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:50.172241Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:a434ff009031bb2f1425a8d257a67dbfbb12a41917db93dec97481a6dc9c6b2b","observation_id":"d2f634a8-fe5f-446c-9fba-df038803177c","resolution":{"observed_at":"2026-08-02T08:21:50.172241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:21:50.176074Z","title":"CV-VAE: A compatible video VAE for latent generative video models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-02T08:21:50.176074Z"},"links":{"citing_paper":"/paper/2607.06173"},"observation_digest":"sha256:5777b4f1a736f8ad677ec0a4bf5dc6ebc04d416bb815441257fa42a42688b52b","observation_id":"b353ad8a-d5ca-4d40-a22f-4d0e875ef7ca","resolution":{"observed_at":"2026-08-02T08:21:50.176074Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.06173","last_updated":"2026-07-26T20:43:47Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-03T04:45:08.357712Z","submitted_at":"2026-07-07T11:52:46Z","title":"MobileWan: Closing the Quality Gap for Mobile Video Diffusion"},"reference_resolution":{"displayed":86,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":85,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":86},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 86 of 86 outbound references and 0 inbound Pith citation observations for arXiv:2607.06173."}