{"as_of":"2026-08-14T20:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d2a790b6408fd2d4b90e9b2133fc88dcd461061f620a504aadc67f1ff87b461c","coverage":[{"denominator":79,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":79,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T15:58:37.128640Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T10:46:29.590722Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-09T10:46:29.894485Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"cited_work":{"arxiv_id":"2412.10494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.10494","snapshot_observed_at":"2026-08-09T10:46:29.894485Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","venue":"cs.CV","work_id":"38e3d1c0-65c7-459e-ab29-8ba4e6f05b64","year":2024},"citing_paper":{"arxiv_id":"2502.04363","last_updated":"2025-03-31T07:22:14Z","snapshot_observed_at":"2026-08-09T15:29:40.182272Z","submitted_at":"2025-02-05T05:42:29Z","title":"On-device Sora: Enabling Training-Free Diffusion-based Text-to-Video Generation for Mobile Devices","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-09T10:46:29.590722Z"},"links":{"cited_paper":"/paper/2412.10494","citing_paper":"/paper/2502.04363"},"observation_digest":"sha256:8890dc5d3e25aedb4fda62cf028676cf8e4faf3c1064d127759e3b3e75738cf3","observation_id":"aaa0229f-04b8-48cb-804a-699ef936120f","resolution":{"observed_at":"2026-08-09T10:46:29.899800Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.10494/citation-record","integrity":"/paper/2412.10494/integrity","json":"/paper/2412.10494/citation-record.json","paper":"/paper/2412.10494"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:39.557160Z","title":"Dream machine","venue":null,"work_id":"706ea4ab-9dea-4e1a-aae5-da1ca6de20b1","year":null},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.270972Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:eeced1e5181571ec6c16e69b2e89852fc9da9a15968a3b23c501b640fc2fb77c","observation_id":"d7acdfb4-80c1-467c-a047-7db6f75a6d49","resolution":{"observed_at":"2026-08-11T15:58:39.601587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:39.488774Z","title":"Pika 1.5","venue":null,"work_id":"9e8f5ced-0adc-4152-bc16-e8d1f0910e98","year":null},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.276925Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:dc037fcd80f937d45f74984be7c97dadbffd0ac7b9cc747354a45dbe7ddae532","observation_id":"375fb975-77f1-468e-8b54-d1ce4856c821","resolution":{"observed_at":"2026-08-11T15:58:39.512295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-11T15:58:35.281573Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.281573Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:6d67553e00b0537d643b1ce19175d007293185d59df5ebc8dd67e63dad20db9f","observation_id":"bd9ed296-518f-4a49-80ac-482783bf5d8c","resolution":{"observed_at":"2026-08-11T15:58:35.281573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:39.474293Z","title":"Align your latents: High-resolution video synthesis with la- tent diffusion models","venue":null,"work_id":"6cc56efb-a019-440f-bde5-8ca28ae0f51e","year":2023},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.286550Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:e7b1233c3f19e5c9d69e19c3c42245c73ab703b32b50a7c288c91273a86ecb07","observation_id":"982bdb0f-c099-445d-9c22-bbf1cdad4577","resolution":{"observed_at":"2026-08-11T15:58:39.479044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-08-13T01:39:12.659510Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-11T15:58:35.290978Z","title":"Videocrafter1: Open diffusion models for high-quality video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.290978Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:9e682cdb9c86f6ee077d96ce8e80363c589fc99a8bbfcfea97c2d12cf886488e","observation_id":"81af9f0c-bbb2-461c-80cf-9e466e58fcc3","resolution":{"observed_at":"2026-08-11T15:58:35.290978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:39.459960Z","title":"Videocrafter2: Overcoming data limitations for high-quality video diffu- sion models","venue":null,"work_id":"5721d06d-08e8-434b-84cd-c30f7399099c","year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.295764Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:9e1ccf336031d60b691dee62025e757990162940e49dfa05bcda296dfc382464","observation_id":"7e9a1c5f-e056-4b8e-8f2f-04514f889558","resolution":{"observed_at":"2026-08-11T15:58:39.464612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:39.445148Z","title":"Panda-70m: Captioning 70m videos with multiple cross-modality teachers","venue":null,"work_id":"e328f9b1-1b7b-47b1-8df2-7ab74032923b","year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.299946Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:1f22df01ce6f84d902347a30408a48ddfbdc55505778148f1e25d1f31ae11e82","observation_id":"c7043144-8895-4fa3-b551-ad09ed96a158","resolution":{"observed_at":"2026-08-11T15:58:39.450228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23788","last_updated":"2024-10-31T10:13:05Z","snapshot_observed_at":"2026-08-12T22:11:00.033924Z","submitted_at":"2024-10-31T10:13:05Z","title":"EDT: An Efficient Diffusion Transformer Framework Inspired by Human-like Sketching","version":1},"cited_work":{"arxiv_id":"2410.23788","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.23788","snapshot_observed_at":"2026-08-11T15:58:38.024055Z","title":"EDT: An Efficient Diffusion Transformer Framework Inspired by Human-like Sketching","venue":"cs.CV","work_id":"8ea85717-ba11-49b5-ab54-4c71d6a46435","year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.304495Z"},"links":{"cited_paper":"/paper/2410.23788","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:b6de514fdf23bc522e212c36649a1b2403ee6931f9ece8921680903117b8816c","observation_id":"6b04187d-40a5-4227-a84b-3e11305a2df3","resolution":{"observed_at":"2026-08-11T15:58:38.029037Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:39.431062Z","title":"Swiftbrush v2: Make your one-step diffusion model better than its teacher","venue":null,"work_id":"fef25923-9c05-464c-8ed5-ad6d38d12010","year":2025},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.309737Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:77df2deb214bb4c15ad3f81e525aaf16ad4284518eb28f3d3310a6ce4c48cd85","observation_id":"ecf29f0a-bc79-4ba9-af17-beab098de248","resolution":{"observed_at":"2026-08-11T15:58:39.435614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:35.315236Z","title":"Scaling recti- fied flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.315236Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:05e62e28539d08888a4973a452f97bdc5cefd11abeb460e80431e83e9051fa51","observation_id":"5e1a1c78-587d-40b1-b8c4-8ccbcf9a87ec","resolution":{"observed_at":"2026-08-11T15:58:35.315236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:39.407119Z","title":"Structural pruning for diffusion models","venue":null,"work_id":"9a15bc20-a76a-44ff-9383-0bd8387f98bc","year":2023},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.319230Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:a83b2d886f79335be072d630816298f69e34134584e8ff1d086360432efae488","observation_id":"50f6f02d-93e3-4d8e-87c2-5cedb0b7b3c4","resolution":{"observed_at":"2026-08-11T15:58:39.411598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:39.392586Z","title":"Wave: Warping ddim inversion features for zero-shot text-to-video editing","venue":null,"work_id":"ae5f01dd-8f8e-4f1c-9e92-8fae8e5e6745","year":2025},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.324110Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:d4a5dd73462b5a88f042e57f42d10ab7641b1bf345858a7cefb9abba1bfad785","observation_id":"29f07a7f-5edb-4f34-ad0d-f3d4d239edf7","resolution":{"observed_at":"2026-08-11T15:58:39.397611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-08-12T14:50:50.360929Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-11T15:58:35.328165Z","title":"Animatediff: Animate your personalized text- to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.328165Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:77417fbbfc749a3b09671b5a3877623374a745c56f3b9562ba75c01f61ff5d51","observation_id":"df73bff1-600e-4d7f-bd30-b843068caa63","resolution":{"observed_at":"2026-08-11T15:58:35.328165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:39.377126Z","title":"Sparsectrl: Adding sparse controls to text-to-video diffusion models","venue":null,"work_id":"d38b8890-420e-4732-86f9-0306a550b59a","year":2025},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.376739Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:53e1d22dfdeabcb743cb01436f38727a292a68003c23ec8309d45db5475c58c9","observation_id":"449ce7c8-a3d8-4eea-ba1a-f2ae0c0b59dd","resolution":{"observed_at":"2026-08-11T15:58:39.382633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-13T05:04:48.764860Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-11T15:58:35.481731Z","title":"Photorealistic video generation with diffusion models.ArXiv preprint, abs/2312.06662, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.481731Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:ebedcbce224036bf417c0f4cbf85fc4cc753de2dbeed69ed94015e9b3836d671","observation_id":"052fda56-3df9-419b-ab7d-135594bdc82d","resolution":{"observed_at":"2026-08-11T15:58:35.481731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-11T15:58:35.580356Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.580356Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:a168d926d867dbee56afa7c15067bb346f1e4dd0a32a0cc04b9269f6705cf4d4","observation_id":"3517e8ef-1b0a-473c-8792-bf129b0dbd26","resolution":{"observed_at":"2026-08-11T15:58:35.580356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:39.360614Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":"9fabff77-a1fc-4b8c-9781-c0c22fb43ecc","year":2020},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.691068Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:064cbe55693170e44ab925c7521287b9a2784d89f0e368bf5b26b5251bcdab80","observation_id":"aa17a6f8-b328-4a5b-bc1a-046e514d34bf","resolution":{"observed_at":"2026-08-11T15:58:39.365586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:39.273080Z","title":"Cogvideo: Large-scale pretraining for text-to-video generation via transformers","venue":null,"work_id":"dafc5db0-4184-4865-8185-bb940c15f732","year":2023},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.695944Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:06e9c6c3acf23a945917de0cb70d582e901afc5efdea38a42965ea618b7bb257","observation_id":"2fcd726a-bcbf-4839-ae12-115f50281d1b","resolution":{"observed_at":"2026-08-11T15:58:39.329696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:39.191134Z","title":"VBench: Com- prehensive benchmark suite for video generative models","venue":null,"work_id":"499f43dc-72dc-488a-9c5f-a12a2296f7da","year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.700156Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:6f21bd84042f8c4462334f4a9ba09a59ba5122a3b4db694b26d1195c0f2bab5a","observation_id":"50de62df-7db2-40cd-ba5b-f63b7de41d27","resolution":{"observed_at":"2026-08-11T15:58:39.218088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12002","last_updated":"2024-07-15T13:34:29Z","snapshot_observed_at":"2026-08-13T00:51:02.345172Z","submitted_at":"2024-03-18T17:38:53Z","title":"DreamMotion: Space-Time Self-Similar Score Distillation for Zero-Shot Video Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12002","snapshot_observed_at":"2026-08-11T15:58:35.704716Z","title":"Dreammotion: Space-time self-similar score distillation for zero-shot video editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.704716Z"},"links":{"cited_paper":"/paper/2403.12002","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:d1dd21a86a3cc1b14ca4555f97afa5e6a3e0d13ae1bb97a740aff27bfe570b70","observation_id":"d7db837b-1c15-43c3-afd9-77dd7d0d922a","resolution":{"observed_at":"2026-08-11T15:58:35.704716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:35.709641Z","title":"Pyramidal flow matching for efficient video generative modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.709641Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:c8e2f9fefeeb6a7e20c98e7a74027f881a4fe48e5562e72dd602e97543a57ae5","observation_id":"49e0cc5e-3dc2-49fc-ac05-3f0a4fdbb42e","resolution":{"observed_at":"2026-08-11T15:58:35.709641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07815","last_updated":"2024-10-10T11:00:55Z","snapshot_observed_at":"2026-08-12T22:26:26.344388Z","submitted_at":"2024-10-10T11:00:55Z","title":"Simple ReFlow: Improved Techniques for Fast Flow Models","version":1},"cited_work":{"arxiv_id":"2410.07815","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.07815","snapshot_observed_at":"2026-08-11T15:58:37.785471Z","title":"Simple ReFlow: Improved Techniques for Fast Flow Models","venue":"cs.LG","work_id":"e4a08a89-fb12-439d-8f1f-b0166fce726d","year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.714250Z"},"links":{"cited_paper":"/paper/2410.07815","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:7ffd1c577b674ae2c8196c43c28d84eb5c26e1970fcaa2b6ca810988423bfef5","observation_id":"f06e6d19-d5af-4414-87dd-41f13eb84a63","resolution":{"observed_at":"2026-08-11T15:58:37.832614Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11473","last_updated":"2024-11-03T12:40:41Z","snapshot_observed_at":"2026-08-13T00:04:24.814743Z","submitted_at":"2024-05-19T07:48:41Z","title":"FIFO-Diffusion: Generating Infinite Videos from Text without Training","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11473","snapshot_observed_at":"2026-08-11T15:58:35.718495Z","title":"Fifo-diffusion: Generating infinite videos from text without training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.718495Z"},"links":{"cited_paper":"/paper/2405.11473","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:a89792628148c87b9e52fb9653f4732c1c28c09001630a32cb599127369d7e9b","observation_id":"875b48d5-6d98-4e48-9dd9-2c630fdd4d76","resolution":{"observed_at":"2026-08-11T15:58:35.718495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:39.178166Z","title":null,"venue":null,"work_id":"4db720b7-6534-4751-a7c6-766a29385252","year":null},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.722753Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:8dd827708f8cc965f759f2efff3ce3a27944295d2e30f8d5cb49b730a1567432","observation_id":"a0112b18-60f9-4ab4-827a-8446eef7b321","resolution":{"observed_at":"2026-08-11T15:58:39.182091Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:39.163317Z","title":"Vivid-1-to-3: Novel view synthesis with video diffusion models","venue":null,"work_id":"7c4753d3-4b77-41ee-a962-6d220a40e69f","year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.727154Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:d0f1dcda61f881db27551707d3d8167a28b8032e03c9c7d5e487a1fe75e8fbdf","observation_id":"0d678e79-c3a8-4204-817a-4f3948fac2de","resolution":{"observed_at":"2026-08-11T15:58:39.168427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:35.732367Z","title":"Open-sora-plan, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.732367Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:1ef5a50b759c116422f6b4179fece8b7fa5806d06e059f960d70a361d8b1d12a","observation_id":"cbfe2bdc-b765-4874-a683-0f4416ab0b33","resolution":{"observed_at":"2026-08-11T15:58:35.732367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18750","last_updated":"2024-10-11T07:50:49Z","snapshot_observed_at":"2026-08-14T11:05:26.691265Z","submitted_at":"2024-05-29T04:26:17Z","title":"T2V-Turbo: Breaking the Quality Bottleneck of Video Consistency Model with Mixed Reward Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18750","snapshot_observed_at":"2026-08-11T15:58:35.736814Z","title":"T2v- turbo: Breaking the quality bottleneck of video consis- tency model with mixed reward feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.736814Z"},"links":{"cited_paper":"/paper/2405.18750","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:7bc6aabb8645c483336498c506ae5d37871390065b0f290610cde14fedcdad48","observation_id":"4b4f4a45-88a1-4813-b3c3-94f17a9983c9","resolution":{"observed_at":"2026-08-11T15:58:35.736814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:35.741527Z","title":"T2v- turbo-v2: Enhancing video generation model post-training through data, reward, and conditional guidance design","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.741527Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:30dcb4d286b7591cafd57a3a32fa024f10ce0fd55d3db5b5d7fd166d59b8e60b","observation_id":"2d408aea-0adb-49e7-8b8f-0d41ba1950b5","resolution":{"observed_at":"2026-08-11T15:58:35.741527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:39.138867Z","title":"Snap- fusion: Text-to-image diffusion model on mobile devices within two seconds","venue":null,"work_id":"b33040d6-5b0b-4b53-9c7a-1a5acaeaf4f7","year":2023},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.746100Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:5be155d450ba1ddd946da96ad8f857839cbbd8206f53cd3d2e0129e308bf40b7","observation_id":"c8507d90-d886-4dca-b11e-5057653a7120","resolution":{"observed_at":"2026-08-11T15:58:39.143592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.998994Z","title":"Flowvid: Taming imperfect optical flows for consistent video-to-video synthesis","venue":null,"work_id":"1bf8819c-c187-4c63-a999-72cbd741a1ff","year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.750452Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:4946dee6cdf83b1d1ef3ba1d6fdfa9ee960a489a1139cbc3a85b8687b2428c7b","observation_id":"774eb584-398c-4fa5-946e-6c906c3f8fad","resolution":{"observed_at":"2026-08-11T15:58:39.085667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.02894","last_updated":"2017-05-09T01:12:28Z","snapshot_observed_at":"2026-07-06T05:41:43.164281Z","submitted_at":"2017-05-08T14:32:33Z","title":"Geometric GAN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.02894","snapshot_observed_at":"2026-08-11T15:58:35.754754Z","title":"Geometric gan","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.754754Z"},"links":{"cited_paper":"/paper/1705.02894","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:554fbf15b47f50ef39737fc7fc0f5105bd98bfb66a617a4c6c70f5032a30e544","observation_id":"70dfb973-cff7-41f8-aed0-759940a1acdd","resolution":{"observed_at":"2026-08-11T15:58:35.754754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12706","last_updated":"2024-03-19T13:08:54Z","snapshot_observed_at":"2026-08-13T00:50:22.589007Z","submitted_at":"2024-03-19T13:08:54Z","title":"AnimateDiff-Lightning: Cross-Model Diffusion Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12706","snapshot_observed_at":"2026-08-11T15:58:35.759562Z","title":"Animatediff-lightning: Cross-model diffusion distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.759562Z"},"links":{"cited_paper":"/paper/2403.12706","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:6458a4865c5a4ae6cd9a7b1d4d9ea247d856fe68e13aaeb4fe5f763f299d67a6","observation_id":"f3d095e8-4907-45d4-875f-f36dd002ca65","resolution":{"observed_at":"2026-08-11T15:58:35.759562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.983062Z","title":"Flow straight and fast: Learning to generate and transfer data with rectified flow","venue":null,"work_id":"665317f6-b217-488f-a759-844cb873fe43","year":2023},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.763843Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:48b87dc4aba40c869d2e6defe94bb36f2c7b6e434d312fc4279b72271a10c6dd","observation_id":"c1bac0e3-612f-427d-a362-3d7c6db7b5ee","resolution":{"observed_at":"2026-08-11T15:58:38.988657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19918","last_updated":"2024-07-29T11:52:07Z","snapshot_observed_at":"2026-08-12T23:12:56.763608Z","submitted_at":"2024-07-29T11:52:07Z","title":"FreeLong: Training-Free Long Video Generation with SpectralBlend Temporal Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19918","snapshot_observed_at":"2026-08-11T15:58:35.768731Z","title":"Free- long: Training-free long video generation with spectralblend temporal attention","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.768731Z"},"links":{"cited_paper":"/paper/2407.19918","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:411f9761c6da7618600de23bf4c95c3912437b7c2ba49ac4a1afff89557f2d21","observation_id":"d79162a1-8ef5-45e6-8344-93dcad5d2b9b","resolution":{"observed_at":"2026-08-11T15:58:35.768731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11367","last_updated":"2025-04-03T07:00:51Z","snapshot_observed_at":"2026-08-12T22:43:03.082130Z","submitted_at":"2024-09-17T17:16:37Z","title":"OSV: One Step is Enough for High-Quality Image to Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11367","snapshot_observed_at":"2026-08-11T15:58:35.844729Z","title":"Osv: One step is enough for high-quality image to video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.844729Z"},"links":{"cited_paper":"/paper/2409.11367","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:c16378fbfc50e4483ca438a24623d91c879aa7f780a2edb63dd7a4a95fd904a6","observation_id":"dbdfa40c-8c58-44a5-a679-c1a912b8ffeb","resolution":{"observed_at":"2026-08-11T15:58:35.844729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.968290Z","title":"Codi: Conditional diffusion distillation for higher-fidelity and faster image generation","venue":null,"work_id":"e385519c-2a1d-49f9-881e-3a7cba0501c5","year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.946369Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:9fb9aa279d5041dc361918ddd8c812c957c91f1f89150658f88f6f55436f826c","observation_id":"21c8dd1f-f472-4d2a-bb40-e2247a6724d2","resolution":{"observed_at":"2026-08-11T15:58:38.973374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.952618Z","title":"Hailuo ai","venue":null,"work_id":"dfa3a49d-8d8f-44eb-b7f6-4aba50ba2a9b","year":null},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.010941Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:da5c34ed389327a42eff6a2f01c26e131482a361c27fadbe1eea638c833750ba","observation_id":"4697f0b6-4e71-4963-ae91-90f8381afe0e","resolution":{"observed_at":"2026-08-11T15:58:38.958593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02371","last_updated":"2025-02-13T10:13:24Z","snapshot_observed_at":"2026-08-07T10:03:56.902190Z","submitted_at":"2024-07-02T15:40:29Z","title":"OpenVid-1M: A Large-Scale High-Quality Dataset for Text-to-video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02371","snapshot_observed_at":"2026-08-11T15:58:36.025518Z","title":"Openvid-1m: A large-scale high-quality dataset for text-to- video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.025518Z"},"links":{"cited_paper":"/paper/2407.02371","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:dd6b42bc06c97e4b63a778a2784bf4a9babde9f8d50f0b788dd4648a8d5c6fcc","observation_id":"841727e8-a7ee-4380-ad50-d911adc5eef1","resolution":{"observed_at":"2026-08-11T15:58:36.025518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.877829Z","title":"Video generation models as world simula- tors","venue":null,"work_id":"abfff90e-d0b9-4e16-a439-7ef2040242e9","year":null},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.034086Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:85eefc31e61590999711dba729f84120315743dcde2abbd0424154e47aab4d4d","observation_id":"c4b54477-bb27-4057-830d-351181f122e6","resolution":{"observed_at":"2026-08-11T15:58:38.917745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.768186Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"718de08e-7cb4-4751-bc9f-4efbbd2f3a35","year":2023},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.040584Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:f2a5cb6f382b853219f23abdf85af2f2650f16eaab0272341d4056b9b8f43ecb","observation_id":"af3e6080-ddb0-4980-972e-f45ea6409f3a","resolution":{"observed_at":"2026-08-11T15:58:38.831692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-08-14T11:08:32.950294Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-11T15:58:36.048232Z","title":"Movie gen: A cast of media foundation models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.048232Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:3493115e1b88f25c6b3beb83ee02b178ceeb0758eb261cfd9e3a85cb9eb127fc","observation_id":"db918a6f-02a5-435b-bd8a-189c4fd5badb","resolution":{"observed_at":"2026-08-11T15:58:36.048232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:36.053406Z","title":"Hier- archical spatio-temporal decoupling for text-to-video gener- ation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.053406Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:158d75a4cfa8c334ce5036c85462fc0743d0a04574e1c8d0d889e5e8425d0877","observation_id":"b1151a26-1d95-43c1-8933-2754c625c9c2","resolution":{"observed_at":"2026-08-11T15:58:36.053406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15169","last_updated":"2024-01-30T16:44:20Z","snapshot_observed_at":"2026-08-13T05:42:52.392821Z","submitted_at":"2023-10-23T17:59:58Z","title":"FreeNoise: Tuning-Free Longer Video Diffusion via Noise Rescheduling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15169","snapshot_observed_at":"2026-08-11T15:58:36.058541Z","title":"Freenoise: Tuning- free longer video diffusion via noise rescheduling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.058541Z"},"links":{"cited_paper":"/paper/2310.15169","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:71397fc56ded902cf1335977dd41052dad0b1319574fa3834b20707cdb6bc693","observation_id":"944c2162-c734-4137-ba30-adfe3a3d009c","resolution":{"observed_at":"2026-08-11T15:58:36.058541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14780","last_updated":"2024-08-28T01:13:44Z","snapshot_observed_at":"2026-08-13T04:12:38.881836Z","submitted_at":"2024-02-22T18:38:48Z","title":"Customize-A-Video: One-Shot Motion Customization of Text-to-Video Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14780","snapshot_observed_at":"2026-08-11T15:58:36.063358Z","title":"Customize-a-video: One-shot motion customization of text- to-video diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.063358Z"},"links":{"cited_paper":"/paper/2402.14780","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:f61f0e9b3dafc8c813163bac8889b9edf603fff3d51c07364e912a0596cf6024","observation_id":"18ae3d34-7589-44df-8f92-4cdecf287a13","resolution":{"observed_at":"2026-08-11T15:58:36.063358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:36.068399Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.068399Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:237d3aef5d53f002c3b8bd60cd0e963d19ba2ffa977cda6e2749ca9ad0964892","observation_id":"5d881cce-9ce9-4edd-a9a6-5d46c6014fb8","resolution":{"observed_at":"2026-08-11T15:58:36.068399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.735070Z","title":"Gen-3 alpha","venue":null,"work_id":"5a3fce14-668e-4152-ba5b-655ea369ca5b","year":null},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.072818Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:0d8576429fed21b3220ceb989acad22e7fc8fd63f9077bf671d390265d8e8be3","observation_id":"47318d1b-eae6-4152-b248-4a1827b3c071","resolution":{"observed_at":"2026-08-11T15:58:38.739450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.720467Z","title":"Progressive distillation for fast sampling of diffusion models","venue":null,"work_id":"51250a3a-10ec-4df2-a062-be11c73ee3fb","year":2022},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.077494Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:a71a1f85ea835dd67754b7be6fc4e5a7271de73ff96eeba1f6e4f423ce77c0f7","observation_id":"87aa8360-3ea5-4654-8710-7cb5a03d0eb0","resolution":{"observed_at":"2026-08-11T15:58:38.724810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.704085Z","title":"Projected gans converge faster","venue":null,"work_id":"be8f13f6-787d-464b-8a32-f707a7aa1c43","year":2021},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.082118Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:b4dfea4b2dc9bd139e43d7371e9be62f37f71be5adb9a8f35cda94704d4a5be9","observation_id":"29c70e5b-5060-4dd8-ab52-6ba73b7f3771","resolution":{"observed_at":"2026-08-11T15:58:38.708549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.656472Z","title":"Stylegan-t: Unlocking the power of gans for fast large-scale text-to-image synthesis","venue":null,"work_id":"9857b1a7-32d7-4a07-9c32-53e55a2b0642","year":2023},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.086722Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:cee43d1251605cae28dda6473e7cde8e1768f137f3e79dc51d503542269ac487","observation_id":"f9e7c5fa-3acd-4638-83ab-5428b0b701f7","resolution":{"observed_at":"2026-08-11T15:58:38.693563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17042","last_updated":"2023-11-28T18:53:24Z","snapshot_observed_at":"2026-08-13T05:15:07.708515Z","submitted_at":"2023-11-28T18:53:24Z","title":"Adversarial Diffusion Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17042","snapshot_observed_at":"2026-08-11T15:58:36.091438Z","title":"Adversarial diffusion distillation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.091438Z"},"links":{"cited_paper":"/paper/2311.17042","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:59c85b50fb2daab099df6a05290048692d837c332ae14b738f9870ce4d2f9bac","observation_id":"a88675a5-079a-476c-b961-bc66a0238c8e","resolution":{"observed_at":"2026-08-11T15:58:36.091438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12015","last_updated":"2024-03-18T17:51:43Z","snapshot_observed_at":"2026-08-14T09:47:47.079404Z","submitted_at":"2024-03-18T17:51:43Z","title":"Fast High-Resolution Image Synthesis with Latent Adversarial Diffusion Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12015","snapshot_observed_at":"2026-08-11T15:58:36.096197Z","title":"Fast high- resolution image synthesis with latent adversarial diffusion distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.096197Z"},"links":{"cited_paper":"/paper/2403.12015","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:ca23f77ce579cfa6e6a7405493ac083894009e6bac301ca23dfc079ad6fac4e4","observation_id":"f6fa165d-b1e9-43fb-9c65-6a3013f8edb7","resolution":{"observed_at":"2026-08-11T15:58:36.096197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14189","last_updated":"2023-10-22T05:33:38Z","snapshot_observed_at":"2026-08-03T16:40:35.231838Z","submitted_at":"2023-10-22T05:33:38Z","title":"Improved Techniques for Training Consistency Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.14189","snapshot_observed_at":"2026-08-11T15:58:36.100693Z","title":"Improved tech- niques for training consistency models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.100693Z"},"links":{"cited_paper":"/paper/2310.14189","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:1abf28fa1eac3845aa2b41ab9724513d170accb1a86b7e3436e1fe96b9896da7","observation_id":"9a45ad51-ecdd-4e22-b749-aba836d98418","resolution":{"observed_at":"2026-08-11T15:58:36.100693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.486042Z","title":"Consistency models","venue":null,"work_id":"f40a5afb-feb7-4359-afc2-f11cefcc01e0","year":2023},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.105163Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:9ea1cff55c865a89923e1f5364ab56cd8609f5e8b1cc14d67c30d486000f7ffc","observation_id":"e7afc44d-d316-4c68-ae7a-3b6e444f384d","resolution":{"observed_at":"2026-08-11T15:58:38.549568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:36.126913Z","title":"Roformer: Enhanced transformer with rotary position embedding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.126913Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:42676f2070e355770f32948b7be79135d6a439794c96e4a005938c692c68e7e7","observation_id":"103baccd-7a65-4729-bcd2-33129b4ab584","resolution":{"observed_at":"2026-08-11T15:58:36.126913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.460385Z","title":"Mochi, 2024","venue":null,"work_id":"f58e02ac-1292-44f3-8a04-8d5089983e8f","year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.264869Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:70c1c55670664327e63c72240ca847d3c0c684ea53da58ea478263b6e0618ec5","observation_id":"03beb475-63fe-433c-a883-11b78b68c82e","resolution":{"observed_at":"2026-08-11T15:58:38.465037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-11T15:58:36.415185Z","title":"Gemini: a family of highly capable multimodal models.ArXiv preprint, abs/2312.11805, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.415185Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:2b281b66518138b40f7f1e6832949588748a7e22175d6273592d4c27f30ea377","observation_id":"999ad951-a74e-429a-b677-c2fa75d4b0c4","resolution":{"observed_at":"2026-08-11T15:58:36.415185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.445039Z","title":"Sv3d: Novel multi-view syn- thesis and 3d generation from a single image using latent video diffusion","venue":null,"work_id":"96026a25-d4cb-459d-a554-103bbcc18787","year":2025},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.573750Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:74870bc784205f394b6a01698b42fe52076aeb0a985ecf64f012773067c1115a","observation_id":"a795bf7e-99ec-4302-ad6d-e46932cc5e15","resolution":{"observed_at":"2026-08-11T15:58:38.450610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00769","last_updated":"2024-10-16T04:53:55Z","snapshot_observed_at":"2026-08-14T11:06:07.336764Z","submitted_at":"2024-02-01T16:58:11Z","title":"AnimateLCM: Computation-Efficient Personalized Style Video Generation without Personalized Video Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00769","snapshot_observed_at":"2026-08-11T15:58:36.579098Z","title":"Animatelcm: Accelerating the animation of personalized diffusion mod- els and adapters with decoupled consistency learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.579098Z"},"links":{"cited_paper":"/paper/2402.00769","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:5ea7d5aadda04bd05efd52cd4a085e3c3aa1e556fd6ff15f32e9a1eb8aa2d18d","observation_id":"83a3c52e-f254-4951-8068-d1a835054225","resolution":{"observed_at":"2026-08-11T15:58:36.579098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07303","last_updated":"2024-10-11T16:17:53Z","snapshot_observed_at":"2026-08-12T22:27:00.163000Z","submitted_at":"2024-10-09T17:43:38Z","title":"Rectified Diffusion: Straightness Is Not Your Need in Rectified Flow","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07303","snapshot_observed_at":"2026-08-11T15:58:36.586534Z","title":"Rectified diffusion: Straightness is not your need in rectified flow","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.586534Z"},"links":{"cited_paper":"/paper/2410.07303","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:677ba8930f3d99838ca0c03dffb1d880038d85e5bee2eb9b6cd1dc8ad47417a4","observation_id":"38b1e59d-9a7f-4f83-a330-b86221dc5fbb","resolution":{"observed_at":"2026-08-11T15:58:36.586534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09109","last_updated":"2023-12-14T16:45:36Z","snapshot_observed_at":"2026-08-14T19:53:40.219639Z","submitted_at":"2023-12-14T16:45:36Z","title":"VideoLCM: Video Latent Consistency Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09109","snapshot_observed_at":"2026-08-11T15:58:36.594481Z","title":"Videolcm: Video latent consistency model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.594481Z"},"links":{"cited_paper":"/paper/2312.09109","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:9b716e811cd9be71dea1296ab8baaee11baf2a456b8c6fccb2fa21c6ba6d8c98","observation_id":"058fee6a-6626-4889-990d-ae23bb582ad2","resolution":{"observed_at":"2026-08-11T15:58:36.594481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17758","last_updated":"2024-10-29T11:56:27Z","snapshot_observed_at":"2026-08-14T15:00:13.744990Z","submitted_at":"2024-06-25T17:42:25Z","title":"MotionBooth: Motion-Aware Customized Text-to-Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17758","snapshot_observed_at":"2026-08-11T15:58:36.599595Z","title":"Mo- tionbooth: Motion-aware customized text-to-video genera- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.599595Z"},"links":{"cited_paper":"/paper/2406.17758","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:68967235b3d5a997e4b18063c6e4a4ed7ecb8b5ce593eeeaccad2139e5f05532","observation_id":"3e613784-0c5b-40f8-850c-5bf2ec8fad7e","resolution":{"observed_at":"2026-08-11T15:58:36.599595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.429917Z","title":"Tune-a-video: One-shot tun- ing of image diffusion models for text-to-video generation","venue":null,"work_id":"e3705216-98a3-44ee-8c0f-f5d8e3763c6c","year":2023},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.605016Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:ecfb2cd1d6bd304de6b6571dce81179e6d09c04f9976b8d623888bc7fa2f0ba2","observation_id":"907f1906-b0bd-4a50-a11e-d98f3e7d7571","resolution":{"observed_at":"2026-08-11T15:58:38.434946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.413472Z","title":"Freeinit: Bridging initialization gap in video dif- fusion models","venue":null,"work_id":"e0a31c34-56e6-41c6-982f-831990c63986","year":2025},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.609643Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:33e36c71d373032573d00e3301139be9dc85b26066e5d161e8d514f8bd9b9963","observation_id":"5abefaab-8a5e-414d-a045-9e55db8fde43","resolution":{"observed_at":"2026-08-11T15:58:38.418941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10629","last_updated":"2024-10-20T14:35:31Z","snapshot_observed_at":"2026-07-06T19:33:08.264958Z","submitted_at":"2024-10-14T15:36:42Z","title":"SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10629","snapshot_observed_at":"2026-08-11T15:58:36.614344Z","title":"Sana: Ef- ficient high-resolution image synthesis with linear diffusion transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.614344Z"},"links":{"cited_paper":"/paper/2410.10629","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:86e26b6689aa002acbfead018288ad72577a36f042258406ab6c13d513bfac48","observation_id":"66444ce5-4b7b-435e-ac15-b8f6920c350d","resolution":{"observed_at":"2026-08-11T15:58:36.614344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.284928Z","title":"Ufogen: You forward once large scale text-to-image gener- ation via diffusion gans","venue":null,"work_id":"e0fdebb7-afe8-4e0a-ba76-f567540ba6a2","year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.619390Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:ae6353958e3b8dd769d7e08e884363610b1b8581e576afaa19dc21b8e3ea25c8","observation_id":"a763c0cd-8c01-4223-a7b7-2063586fa1fc","resolution":{"observed_at":"2026-08-11T15:58:38.334958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02398","last_updated":"2024-07-02T16:15:37Z","snapshot_observed_at":"2026-08-14T05:09:02.919998Z","submitted_at":"2024-07-02T16:15:37Z","title":"Consistency Flow Matching: Defining Straight Flows with Velocity Consistency","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02398","snapshot_observed_at":"2026-08-11T15:58:36.624252Z","title":"Consistency flow matching: Defining straight flows with velocity consistency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.624252Z"},"links":{"cited_paper":"/paper/2407.02398","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:1a7bb4870054b63da5c8180c9db40bf84d2925554dd99af96d25a10c0575ef69","observation_id":"d0084f01-f80b-4035-9e3c-80baa0fa256f","resolution":{"observed_at":"2026-08-11T15:58:36.624252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-11T15:58:36.628848Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.628848Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:2a12b1f24a715cc6551707f1e76cba7f805a75a6ef17f293a0825e41b0ae0a8c","observation_id":"749e175a-dd8d-4773-8b88-4ff53dedf449","resolution":{"observed_at":"2026-08-11T15:58:36.628848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14867","last_updated":"2024-05-24T17:08:32Z","snapshot_observed_at":"2026-08-12T23:59:30.187265Z","submitted_at":"2024-05-23T17:59:49Z","title":"Improved Distribution Matching Distillation for Fast Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14867","snapshot_observed_at":"2026-08-11T15:58:36.633619Z","title":"Im- proved distribution matching distillation for fast image syn- thesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.633619Z"},"links":{"cited_paper":"/paper/2405.14867","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:637d2eada33de5753fb95da53fc318ea173eefaa0ead80a1248057f12157f7c4","observation_id":"eb1fa1b3-256d-42f5-8d39-fccb5a3be6ec","resolution":{"observed_at":"2026-08-11T15:58:36.633619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:36.638064Z","title":"One-step diffusion with distribution matching distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.638064Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:b2c1e1277202829942bc0216dab647543a36dbf4194affb97846dcc910f10ffc","observation_id":"f7d6772a-1636-4fa3-bbd5-5c40baf6ac90","resolution":{"observed_at":"2026-08-11T15:58:36.638064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08552","last_updated":"2024-10-18T12:05:21Z","snapshot_observed_at":"2026-08-12T23:44:14.637538Z","submitted_at":"2024-06-12T18:00:08Z","title":"DiTFastAttn: Attention Compression for Diffusion Transformer Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08552","snapshot_observed_at":"2026-08-11T15:58:36.642635Z","title":"Ditfastattn: Attention compression for diffusion transformer models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.642635Z"},"links":{"cited_paper":"/paper/2406.08552","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:5d5303b404eba51c522cb347258601b785035d7c934c9d6087262885a85166ba","observation_id":"f23ffbd7-3a4b-46a0-9727-e8431c26eca7","resolution":{"observed_at":"2026-08-11T15:58:36.642635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:36.716519Z","title":"Make pixels dance: High- dynamic video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.716519Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:4c711b4d8fad7d1eea243f35e9e521c33f5da773b9f506f9f60f38fafe490531","observation_id":"f96d582a-edee-45bb-be89-31b502178822","resolution":{"observed_at":"2026-08-11T15:58:36.716519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06890","last_updated":"2024-10-26T22:27:02Z","snapshot_observed_at":"2026-08-14T16:19:57.294745Z","submitted_at":"2024-06-11T02:09:46Z","title":"Motion Consistency Model: Accelerating Video Diffusion with Disentangled Motion-Appearance Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06890","snapshot_observed_at":"2026-08-11T15:58:36.924366Z","title":"Motion consistency model: Accel- erating video diffusion with disentangled motion-appearance distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:36.924366Z"},"links":{"cited_paper":"/paper/2406.06890","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:cee3fdd4584aaf83f1dd0bdeea7642f961e25ccbdaaa9dde8e438ec632977021","observation_id":"c2a36a3e-e174-4269-bf9d-a156b0ea32c4","resolution":{"observed_at":"2026-08-11T15:58:36.924366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.250343Z","title":"Fast and memory-efficient video dif- fusion using streamlined inference","venue":null,"work_id":"9ada0ddb-ff15-4115-9b12-f35a0a596975","year":null},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:37.035143Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:28a37be5ea6f5aaea8494c073b55b34c79519cee54719f223ca87fdf62d7169d","observation_id":"058fa9b4-b696-4020-be80-0f1499b70913","resolution":{"observed_at":"2026-08-11T15:58:38.254741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04324","last_updated":"2024-10-24T18:50:24Z","snapshot_observed_at":"2026-08-14T01:32:56.279023Z","submitted_at":"2024-06-06T17:58:27Z","title":"SF-V: Single Forward Video Generation Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04324","snapshot_observed_at":"2026-08-11T15:58:37.080731Z","title":"Sf-v: Single forward video generation model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:37.080731Z"},"links":{"cited_paper":"/paper/2406.04324","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:5d546953533018778947573f23f0f3db7ed5f0556596a61f001d06cf71da5506","observation_id":"ccdb3ed6-5396-449a-9e78-fb88f9d13b46","resolution":{"observed_at":"2026-08-11T15:58:37.080731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.235058Z","title":"Avid: Any-length video inpainting with dif- fusion model","venue":null,"work_id":"c34e347a-8da7-465a-bafe-3cb505cf0f92","year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:37.110239Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:2023ef43c396f0fdb69e1ddff26061f276448fe8317ff496ad6ca9fc92b096a9","observation_id":"f3a76f96-5f21-453c-89a0-925c97febc32","resolution":{"observed_at":"2026-08-11T15:58:38.239727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.220148Z","title":"Motiondirector: Motion customization of text-to-video diffusion models","venue":null,"work_id":"28617639-44e3-4cde-89b9-a3e513416169","year":2025},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:37.115351Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:22a1474d76195e957cead626cbe3638b0eab5f28a598bdd5fbce9f45af780728","observation_id":"ee00efe8-030e-48aa-9f16-5b11326ab788","resolution":{"observed_at":"2026-08-11T15:58:38.225064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.204627Z","title":"Open-sora: Democratizing efficient video production for all, 2024","venue":null,"work_id":"66c1774e-5a88-416f-943b-3b23b6c64727","year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:37.119901Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:b021f5cec547e9dc1a98da15cddeb1c78f1778051b7899498cb511bd49dedfd2","observation_id":"1f5bd748-b7a2-4fd5-812e-bb56f26c3cad","resolution":{"observed_at":"2026-08-11T15:58:38.210064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15458","last_updated":"2024-10-20T17:51:35Z","snapshot_observed_at":"2026-08-12T22:19:09.109938Z","submitted_at":"2024-10-20T17:51:35Z","title":"Allegro: Open the Black Box of Commercial-Level Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15458","snapshot_observed_at":"2026-08-11T15:58:37.123917Z","title":"Al- legro: Open the black box of commercial-level video gener- ation model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:37.123917Z"},"links":{"cited_paper":"/paper/2410.15458","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:5efd5826855ff03eefa0891bb2f549611cbd8e5a7c96aab364f2eee83465d37a","observation_id":"81d642ca-10aa-4bc9-a2ff-0970eafa2160","resolution":{"observed_at":"2026-08-11T15:58:37.123917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:58:38.071369Z","title":"Golden Retriever and French Bulldog go through a dark corridor of abandoned alien spacecraft. Sci-fi horror movie style,","venue":null,"work_id":"2734f07e-90b8-46a3-9b1a-51b7601d660d","year":2024},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:37.128640Z"},"links":{"citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:9a639b98bd58bed532453125368680f5eb03faddfa68deaa9fcde60596b1b5be","observation_id":"f3cdea2c-bd51-47a9-85aa-c6870f3596c1","resolution":{"observed_at":"2026-08-11T15:58:38.140520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T02:05:57.506448Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device"},"reference_resolution":{"displayed":79,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":2,"verified_fuzzy":35},"total_outbound_references":79},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 79 of 79 outbound references and 1 inbound Pith citation observation for arXiv:2412.10494."}