{"as_of":"2026-08-12T08:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:17f3760231148c6233beb50ea04125b738b9cc7b381f47f6577a167f364f944f","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T18:11:39.642701Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2603.21002/citation-record","integrity":"/paper/2603.21002/integrity","json":"/paper/2603.21002/citation-record.json","paper":"/paper/2603.21002"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.03520","last_updated":"2024-10-03T17:24:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-05T17:53:55Z","title":"VideoPhy: Evaluating Physical Commonsense for Video Generation","version":2},"cited_work":{"arxiv_id":"2406.03520","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.03520","snapshot_observed_at":"2026-07-07T15:43:53.689981Z","title":"VideoPhy: Evaluating Physical Commonsense for Video Generation","venue":"cs.CV","work_id":"27ed795c-abbe-4de1-9a7a-2ecf39c354f3","year":2024},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2406.03520","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:8fc8968ef2424f2e19518cd3989acfabaede8834c6b308388600b2fd1f447abe","observation_id":"893e5fce-503c-4ec4-8973-c508b8e54a08","resolution":{"observed_at":"2026-05-21T18:14:17.519449Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08113","last_updated":"2023-02-16T06:28:29Z","snapshot_observed_at":"2026-08-07T03:49:49.341219Z","submitted_at":"2023-02-16T06:28:29Z","title":"MultiDiffusion: Fusing Diffusion Paths for Controlled Image Generation","version":1},"cited_work":{"arxiv_id":"2302.08113","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.08113","snapshot_observed_at":"2026-07-07T12:53:50.466635Z","title":"Multidiffusion: Fusing diffusion paths for controlled image generation","venue":"cs.CV","work_id":"1a06e9b7-e97f-4665-ba6e-55301822d3b6","year":2023},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2302.08113","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:51508b2446f15b424e8f6e30a55a4f26d4d31c1edc38c3ead0a111465fa60f5c","observation_id":"fffe2cc1-da2a-49f5-828b-b4e1dd0bde57","resolution":{"observed_at":"2026-05-21T18:14:17.469188Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficientvit: Lightweight multi-scale attention for high-resolution dense prediction","venue":null,"work_id":"5ece7bf4-3b3f-4a20-99fe-7d21ff694472","year":2023},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:7c086c61a7cbaef0c44671ea5ad89534b3385bfd7cbeb154a424f08a1e2f2d15","observation_id":"af2a9d6b-3024-4aeb-8a8f-081b67372c02","resolution":{"observed_at":"2026-05-21T18:14:17.895392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emerging properties in self-supervised vision transformers","venue":null,"work_id":"ad58d9e2-33ef-4fbc-85fa-697e7326f3e9","year":2021},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:ae0c1b1f13211891fffa9dacba817b22a36292cfcfbb58ddf4adf65666b3aa6d","observation_id":"d245bbaa-1e3b-49de-a5db-7bd6b3551c5a","resolution":{"observed_at":"2026-05-21T18:14:17.865422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04692","last_updated":"2024-03-17T16:59:25Z","snapshot_observed_at":"2026-08-11T01:07:36.814668Z","submitted_at":"2024-03-07T17:41:37Z","title":"PixArt-\\Sigma: Weak-to-Strong Training of Diffusion Transformer for 4K Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":"2403.04692","doi":"10.48550/arxiv.2403.04692","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.04692","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixart- \\sigma: Weak-to-strong training of diffusion transformer for 4k text-to-image generation","venue":"arXiv (Cornell University)","work_id":"5dc0cfb7-2014-4631-be70-f632bf6ca9ec","year":2024},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2403.04692","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:702f667075ae7438e50fcc7c585b5a045d4df965020cddc01b68bf531018b12c","observation_id":"68bd0e14-cad3-4529-935b-429b68459ca0","resolution":{"observed_at":"2026-05-21T18:14:17.450007Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07963","last_updated":"2025-04-10T17:59:56Z","snapshot_observed_at":"2026-08-10T13:40:29.599895Z","submitted_at":"2025-04-10T17:59:56Z","title":"PixelFlow: Pixel-Space Generative Models with Flow","version":1},"cited_work":{"arxiv_id":"2504.07963","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.07963","snapshot_observed_at":"2026-07-04T20:50:11.498748Z","title":"arXiv preprint arXiv:2504.07963 (2025)","venue":null,"work_id":"1beb1a44-0887-4a87-93c8-5dca148563bd","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2504.07963","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:699f33ae76dd952dcf21ba34c24a6c9b6400d750d379ca9f8efb137a2263812a","observation_id":"86f1c0c0-04bb-4e96-abc7-e3e693c9a11e","resolution":{"observed_at":"2026-05-21T18:14:17.499021Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Resadapter: Domain consistent resolution adapter for diffusion models","venue":null,"work_id":"1ec103c8-0893-4867-847e-99a645024607","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:b1c8642cfc7c3f62d2ed3db712557c6ac35b3d0b3e2434f3df093cb784f5210d","observation_id":"6dd89aeb-f680-4ae4-8b80-f627be39488a","resolution":{"observed_at":"2026-05-21T18:14:17.900022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14794","last_updated":"2022-11-19T12:45:21Z","snapshot_observed_at":"2026-08-12T04:58:34.201421Z","submitted_at":"2020-09-30T17:09:09Z","title":"Rethinking Attention with Performers","version":4},"cited_work":{"arxiv_id":"2009.14794","doi":"10.48550/arxiv.2009.14794","metadata_source":"pith","pith_arxiv_id":"2009.14794","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Rethinking Attention with Performers","venue":"cs.LG","work_id":"4c26d308-8b72-4a98-8e73-950617a75f50","year":2020},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2009.14794","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:854d0050a57106cf41eb2f21a562495e9fb4381ed5e35fe1f68dbd538c22b4aa","observation_id":"839a28cc-1afd-4182-9264-df378528d5e0","resolution":{"observed_at":"2026-05-21T18:14:17.509370Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:49:59.959694+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:49:59.959694+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher R ´e","venue":null,"work_id":"b5c64fbc-979a-40a9-81ec-d9fcce23ecc6","year":2022},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:e9d66b61f63ffdcf4e558f8a76f046a22e8205fc8896fcb9820fc85efab78a0b","observation_id":"3f58aaa0-ad9c-40bf-9173-0af2bcf76772","resolution":{"observed_at":"2026-05-21T18:14:17.891091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06155","last_updated":"2025-02-17T07:08:23Z","snapshot_observed_at":"2026-08-10T08:45:38.806056Z","submitted_at":"2025-02-10T05:00:56Z","title":"Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile","version":2},"cited_work":{"arxiv_id":"2502.06155","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06155","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient-vdit: Efficient video diffusion transformers with attention tile","venue":null,"work_id":"55e7d21d-77c6-4bfb-bb90-d47aab8cd73e","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2502.06155","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:b33a4a9f3b9368ad155615e18780fa0c2503c0a1acc2eff5db9afe2491584953","observation_id":"1cd29495-3fdc-4fb0-b51f-6c0b3c14d5f8","resolution":{"observed_at":"2026-05-21T18:14:17.530161Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15689","last_updated":"2026-05-06T21:36:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-20T09:07:36Z","title":"DOLLAR: Few-Step Video Generation via Distillation and Latent Reward Optimization","version":2},"cited_work":{"arxiv_id":"2412.15689","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.15689","snapshot_observed_at":"2026-07-02T07:16:44.974356Z","title":"DOLLAR: Few-Step Video Generation via Distillation and Latent Reward Optimization","venue":"cs.CV","work_id":"6bf2990a-ec2c-4fd6-9c25-2ccd60826832","year":2024},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2412.15689","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:5e44484070c5fddc95857a156a02a993302c95cabf745dbb6d8b344017b0220a","observation_id":"d7bbff3e-2ed1-42fb-aec3-a92be0e2e9d6","resolution":{"observed_at":"2026-05-21T18:14:17.465340Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Demofusion: Democratising high-resolution image generation with no $$$","venue":null,"work_id":"1bac643b-aa34-42d3-bb7a-de388e3cb9c0","year":2024},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:1ae76b02813d4e2b120b60192bb80d68905b7a3ccea2987f80ab1cd3d9f4e16b","observation_id":"4a56da0b-af61-4a55-88d8-e0c884864032","resolution":{"observed_at":"2026-05-21T18:14:17.889566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling rectified flow transformers for high- resolution image synthesis","venue":null,"work_id":"9614aaad-a841-445d-abdd-764783e8293a","year":2024},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:74cb9ef9a1518e579357512e174814e7c6d2637c7479e08b26991344abaffcae","observation_id":"e1f79c7b-9d93-41ba-b4d1-489c4765c7c2","resolution":{"observed_at":"2026-05-21T18:14:17.902500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalecrafter: Tuning-free higher-resolution visual generation with diffusion models","venue":null,"work_id":"6b566478-673b-4e12-a66e-f1ba18397e20","year":2024},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:6c721c1d6a49afdb69ca1271d7040b8c94ca690ca0e1df829ae47beb73dd7c9e","observation_id":"f2c2db09-3da8-491d-94c7-3aa48f0199fd","resolution":{"observed_at":"2026-05-21T18:14:17.913500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12963","last_updated":"2024-03-19T17:59:33Z","snapshot_observed_at":"2026-07-06T17:47:13.814205Z","submitted_at":"2024-03-19T17:59:33Z","title":"FouriScale: A Frequency Perspective on Training-Free High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":"2403.12963","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.12963","snapshot_observed_at":"2026-06-28T19:32:35.229556Z","title":"Fouriscale: A frequency perspective on training-free high-resolution image synthesis","venue":null,"work_id":"f2a2dfec-6a02-4019-a65b-f3d1a8e20225","year":2024},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2403.12963","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:52f501899b9f478e79b9bf0baa9d3ef64cc1e0ba5cea96bb589a4dee32c86bc0","observation_id":"3b31aef2-71bf-4a8f-bdb9-b70165bdc1cc","resolution":{"observed_at":"2026-05-21T18:14:17.508014Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":"7a859a99-d94f-4831-bab4-6a2370055fda","year":2024},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:105aee5b35ed094d5f147376ef4d3cf300103ebca8b906710c701ba689b5c25f","observation_id":"d6ef61d9-2806-4ba3-8de9-800c0b30ac44","resolution":{"observed_at":"2026-05-21T18:14:17.889178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Transformers are rnns: Fast autoregressive transformers with linear attention","venue":null,"work_id":"406e0d1a-e6c2-43d0-91bb-876aef895877","year":2020},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:55cdd36e3c75c1c3b9c92d77f5b9e39b7a4eb68e5b7ee46c74fe4ee7b081e7b2","observation_id":"0b385ed2-ee3f-4609-ba7f-4352be0d47ef","resolution":{"observed_at":"2026-05-21T18:14:17.906642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":"2412.03603","doi":"10.48550/arxiv.2412.03603","metadata_source":"pith","pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","venue":"cs.CV","work_id":"881efa7e-7e73-4c66-9cc3-2803e551061c","year":2024},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:7ec4ff2fd1ceec42d8d08eddf1d5385f0192b90bf89cceaa525f1874dffac8f6","observation_id":"4fece48d-b048-4546-84cf-4b06dac137a1","resolution":{"observed_at":"2026-05-21T18:14:17.501138Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kling ai.https://klingai.com/","venue":null,"work_id":"e0b6bde5-6014-4aa6-953a-3f8e647ce486","year":null},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:e0e18f64eadad14302ac676faa6bf9d4fa1c29d43a5b5de613c1fb3241c9c679","observation_id":"5b170b5c-455b-4c56-b322-fff1f7dc24df","resolution":{"observed_at":"2026-05-21T18:14:17.887090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Syncdiffusion: Coherent montage via synchronized joint diffusions","venue":null,"work_id":"0af37a97-76db-4897-b57a-c89ae3e88694","year":null},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:5233e98f4bc70327322562e34ecc66f20cff89ba11e802077ced747fe8d77317","observation_id":"11765f1f-69d4-48bd-94a7-9d4aa8236510","resolution":{"observed_at":"2026-05-21T18:14:17.893070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02919","last_updated":"2024-09-09T09:11:28Z","snapshot_observed_at":"2026-07-06T19:10:34.393689Z","submitted_at":"2024-09-04T17:58:08Z","title":"HiPrompt: Tuning-free Higher-Resolution Generation with Hierarchical MLLM Prompts","version":3},"cited_work":{"arxiv_id":"2409.02919","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.02919","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hiprompt: Tuning-free higher-resolution gen- eration with hierarchical mllm prompts","venue":null,"work_id":"409c7582-2175-4d9a-aa9e-2ca61f56f7dd","year":2024},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2409.02919","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:a0d9a717797ad72d9b46c7c18a43f4d13da916c2664241302a78f50a4e9ce640","observation_id":"8e720677-3b18-4f6c-a6b3-3ab15e9a7411","resolution":{"observed_at":"2026-05-21T18:14:17.450205Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04378","last_updated":"2023-10-06T17:11:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-06T17:11:58Z","title":"Latent Consistency Models: Synthesizing High-Resolution Images with Few-Step Inference","version":1},"cited_work":{"arxiv_id":"2310.04378","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.04378","snapshot_observed_at":"2026-07-08T10:54:49.201621Z","title":"Latent Consistency Models: Synthesizing High-Resolution Images with Few-Step Inference","venue":"cs.CV","work_id":"53b1d836-7feb-402c-97c7-87b9bc51196f","year":2023},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2310.04378","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:f714395c85f6e343209585f83221a5ce804071ec59303038413187c8650b7bb3","observation_id":"cd5caf65-b1a6-4c22-9b7d-fe34b5b2f19f","resolution":{"observed_at":"2026-05-21T18:14:17.513322Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05363","last_updated":"2024-10-07T17:56:04Z","snapshot_observed_at":"2026-08-08T09:48:34.424815Z","submitted_at":"2024-10-07T17:56:04Z","title":"Towards World Simulator: Crafting Physical Commonsense-Based Benchmark for Video Generation","version":1},"cited_work":{"arxiv_id":"2410.05363","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.05363","snapshot_observed_at":"2026-07-08T07:14:45.198485Z","title":"Towards World Simulator: Crafting Physical Commonsense-Based Benchmark for Video Generation","venue":"cs.CV","work_id":"644e2886-7387-436d-ac11-d848af5fcc71","year":2024},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2410.05363","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:f13be8349d6b9c65ea0b51ad06585d0c6b72e31acea79c3e7c2dc3e1f1ca6aaa","observation_id":"a4a535c1-128d-4b1e-ae38-6f144565982e","resolution":{"observed_at":"2026-05-21T18:14:17.493935Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"6c309667-7036-4d9c-8119-4d5d6aa38faa","year":2021},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:b56a8ef2951f16bdf8a270f3a9fb7c8019fc400f17d065edb681e81084b21c61","observation_id":"c76c887d-5602-4e04-9f1b-804f6ffe88fb","resolution":{"observed_at":"2026-05-21T18:14:17.904676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02158","last_updated":"2024-07-04T08:11:19Z","snapshot_observed_at":"2026-08-06T03:43:31.331538Z","submitted_at":"2024-07-02T11:02:19Z","title":"UltraPixel: Advancing Ultra-High-Resolution Image Synthesis to New Peaks","version":2},"cited_work":{"arxiv_id":"2407.02158","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.02158","snapshot_observed_at":"2026-07-03T00:37:29.779352Z","title":"Ultrapixel: Advancing ultra-high-resolution image synthesis to new peaks","venue":null,"work_id":"054ed2a1-9b33-4518-b62d-53ec630cabda","year":2024},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2407.02158","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:1fd0f7909007f5fb00b8186f92e5819d3b940f80e0d71c3d680394b2ef92444e","observation_id":"3eee8595-695f-47fe-be4b-dc24a1ce4f26","resolution":{"observed_at":"2026-05-21T18:14:17.439985Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-07T16:00:51.508846Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"cited_work":{"arxiv_id":"2504.14470","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.14470","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Turbo2k: Towards ultra-efficient and high-quality 2k video synthesis","venue":null,"work_id":"cd9ab608-3394-482e-99ca-c18947537e1c","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2504.14470","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:37476ed628cbb6705a0afc0912df935ccc7a3b375def5d59532894473af83023","observation_id":"8ac90f75-9251-4c56-b33c-46dec4595a7e","resolution":{"observed_at":"2026-05-21T18:14:17.489304Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Laion-5b: An open large- scale dataset for training next generation image-text models.Advances in neural information processing systems, 35:25278–25294","venue":null,"work_id":"cc2193c0-ec89-470e-996d-1a03d8c28287","year":2022},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:fbfcba0172dcc68c0cf46629ef481f84b8d8016278cadb749362c2a650ebc40f","observation_id":"34e58422-0184-4730-9138-9de4fb45b490","resolution":{"observed_at":"2026-05-21T18:14:17.910970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16476","last_updated":"2024-06-24T09:28:21Z","snapshot_observed_at":"2026-08-04T11:16:52.864742Z","submitted_at":"2024-06-24T09:28:21Z","title":"ResMaster: Mastering High-Resolution Image Generation via Structural and Fine-Grained Guidance","version":1},"cited_work":{"arxiv_id":"2406.16476","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16476","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Resmaster: Mastering high- resolution image generation via structural and fine-grained guidance","venue":null,"work_id":"9fb256a2-db8f-4c8f-99fb-511358aafeb5","year":2024},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2406.16476","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:20d171500612fd85e37f047d2975ca6152375895664b4e5c0b71b7e8ab7c96ff","observation_id":"4c5490b2-d5a9-4b0b-908f-7bd97d5724cf","resolution":{"observed_at":"2026-05-21T18:14:17.474174Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.16397","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T12:26:56.438323Z","title":"Scale-wise distillation of diffusion models","venue":null,"work_id":"1378e6c0-2232-4bb3-92d7-af73a41386d6","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:01ff470360759de427255ca2b2ff165d7645f2a7d1e4295bfb8716f87c5ce340","observation_id":"44b8e117-6177-4f17-848c-60404b872900","resolution":{"observed_at":"2026-05-21T18:14:17.503416Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Roformer: Enhanced transformer with rotary position embedding.Neuro- computing, 568:127063","venue":null,"work_id":"ff24edcc-79cd-414e-889f-2201275eff65","year":2024},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:3691999997ec66954a91064e20006cde2047bbcc91c7da8eceabba3540c98c54","observation_id":"6c401b39-90ed-482c-a56f-75c7ba90a9bb","resolution":{"observed_at":"2026-05-21T18:14:17.908747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fastvideo: A unified frame- work for accelerated video generation, April 2024","venue":null,"work_id":"1c3c5f99-c160-437f-bcad-8b21ca8bd1b7","year":2024},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:86bf52b2a5f5b86688aac836bf404c37571ed1871e8db33d69dea6e65f550b7c","observation_id":"6fb02373-4337-4256-96f4-85850931f1e9","resolution":{"observed_at":"2026-05-21T18:14:17.897427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18940","last_updated":"2025-03-27T13:05:19Z","snapshot_observed_at":"2026-08-07T16:40:28.227753Z","submitted_at":"2025-03-24T17:59:02Z","title":"Training-free Diffusion Acceleration with Bottleneck Sampling","version":2},"cited_work":{"arxiv_id":"2503.18940","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.18940","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training-free diffusion acceleration with bot- tleneck sampling.arXiv preprint arXiv:2503.18940","venue":null,"work_id":"6e914272-68d1-4a95-b99b-97dc20e11017","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2503.18940","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:6cc98591fe53bf89ef3ad20f4e9873a2ac01c4a8efdf277e31d1ef6f7b526603","observation_id":"26dfaf96-99e6-46af-b129-63c0556e90da","resolution":{"observed_at":"2026-05-21T18:14:17.524048Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:276973c2f10bde7a23654dd0f22e77db82a454949ea2711fd572bdfe1fc0b0bd","observation_id":"feb945a2-2c02-4cac-a45b-34ac1ca6fbd6","resolution":{"observed_at":"2026-05-21T18:14:17.592571Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01320","last_updated":"2025-03-22T07:44:02Z","snapshot_observed_at":"2026-08-11T01:08:02.605430Z","submitted_at":"2025-01-02T16:19:48Z","title":"SeedVR: Seeding Infinity in Diffusion Transformer Towards Generic Video Restoration","version":4},"cited_work":{"arxiv_id":"2501.01320","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01320","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Seedvr: Seeding infinity in diffusion transformer towards generic video restoration","venue":null,"work_id":"a5292f98-1c46-4567-8fc1-396da864682e","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2501.01320","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:541efefbe3295461eeae215b8f4a71c02a768144a8b6b0fff4fa73ac2fc4da74","observation_id":"cd963546-6a6e-4856-89fc-508233097579","resolution":{"observed_at":"2026-05-21T18:14:17.583788Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":"2006.04768","doi":"10.48550/arxiv.2006.04768","metadata_source":"pith","pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Linformer: Self-Attention with Linear Complexity","venue":"cs.LG","work_id":"4b717b51-6098-45d0-8e9e-b69bef651bc3","year":2020},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:826d7bf25885496f022dae615bcf476c966f6bc3453691f87879689b1a4c6add","observation_id":"ac846981-9de7-4ee4-a787-2d856637e683","resolution":{"observed_at":"2026-05-21T18:14:17.580686Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Real-esrgan: Training real-world blind super- resolution with pure synthetic data","venue":null,"work_id":"b7f87edf-547a-45a4-b653-69a85d10eb6f","year":null},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:024143cd5070afa1c052f9015c9ae17d1204e20365f7cb3a9c586d1869f7545f","observation_id":"dc465335-de1f-4109-93c3-5f132ff3dbe0","resolution":{"observed_at":"2026-05-21T18:14:17.918596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exploring video quality assessment on user generated contents from aesthetic and technical perspectives","venue":null,"work_id":"1a6204d7-77aa-4edb-825d-5f4307fcc21e","year":2023},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:f886fd45248ad256ecb79a5ce805e44fc3a27275fea8b505c25964b9438f658c","observation_id":"6f24975b-184f-4619-9269-a0963c6d9380","resolution":{"observed_at":"2026-05-21T18:14:17.916337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-10T06:09:21.088224Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:7bcb941ea30be6daa6ba5565a011a732c2e9a9b7dc7c02a94be211315d5449a8","observation_id":"0e6c0224-9558-48ca-bf5d-0bd1bc36ccfb","resolution":{"observed_at":"2026-05-21T18:14:17.576394Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.21079","last_updated":"2025-02-28T14:11:20Z","snapshot_observed_at":"2026-08-07T17:39:41.540184Z","submitted_at":"2025-02-28T14:11:20Z","title":"Training-free and Adaptive Sparse Attention for Efficient Long Video Generation","version":1},"cited_work":{"arxiv_id":"2502.21079","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.21079","snapshot_observed_at":"2026-07-02T12:26:56.731258Z","title":"Training-free and adaptive sparse attention for efficient long video generation","venue":null,"work_id":"33e5bf65-e076-486f-ad32-ce01642ddb43","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2502.21079","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:a300398923818b0ed1f48ec4fad721d464b29283473a55643f0b192236d7703f","observation_id":"67419f92-ab97-404b-8a1a-a826759c1f0d","resolution":{"observed_at":"2026-05-21T18:14:17.541641Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10629","last_updated":"2024-10-20T14:35:31Z","snapshot_observed_at":"2026-07-06T19:33:08.264958Z","submitted_at":"2024-10-14T15:36:42Z","title":"SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers","version":3},"cited_work":{"arxiv_id":"2410.10629","doi":"10.48550/arxiv.2410.10629","metadata_source":"pith","pith_arxiv_id":"2410.10629","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers","venue":"cs.CV","work_id":"c53bf282-3c74-4c37-a7bd-6531aee212b8","year":2024},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2410.10629","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:f4f0215926c9c1c644e3e6c6943ae2d7f813d2726d542dbc5aed97c12ac752dd","observation_id":"3b5e09b3-e632-4313-8533-7e405e77c694","resolution":{"observed_at":"2026-05-21T18:14:17.599579Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":"2505.18875","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-07-04T08:49:41.575846Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","venue":"cs.CV","work_id":"decf2600-7c29-49c9-b5e5-a399c4eea166","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:7faaa7d79afc5c8118bcf5171e99205a4c44134542c556c06c955ba5c55b38b3","observation_id":"ef0157d1-3b00-4a16-8877-2d00dcfbd723","resolution":{"observed_at":"2026-05-21T18:14:17.561929Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":"2408.06072","doi":"10.48550/arxiv.2408.06072","metadata_source":"pith","pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","venue":"cs.CV","work_id":"f38fc088-12aa-4bf4-9ecd-08d3e797ccb7","year":2024},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:dae2bd12b8a75c66b44af34ad25a599b3b1d77dc99fc458cec343090e69567a8","observation_id":"fc622393-e029-457e-bdfb-e8fa4ea1412b","resolution":{"observed_at":"2026-05-21T18:14:17.596103Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Metaformer is actually what you need for vision","venue":null,"work_id":"fe6d6a3c-b1a7-41e6-8658-cec703ac4923","year":2022},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:bbf186b34940942a65ca34754fe0463c967dbba7a91fc54257dab8605b097776","observation_id":"aed4e9bd-11ca-4968-addc-931d792a6e49","resolution":{"observed_at":"2026-05-21T18:14:17.921001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19462","last_updated":"2025-03-25T08:52:07Z","snapshot_observed_at":"2026-08-07T16:38:59.807618Z","submitted_at":"2025-03-25T08:52:07Z","title":"AccVideo: Accelerating Video Diffusion Model with Synthetic Dataset","version":1},"cited_work":{"arxiv_id":"2503.19462","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.19462","snapshot_observed_at":"2026-06-29T18:13:48.828213Z","title":"Accvideo: Accel- erating video diffusion model with synthetic dataset","venue":null,"work_id":"a6beba96-ba82-4d65-adf5-8a865635ee20","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2503.19462","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:13764c96087873c2c126a1e26d6d54e5f6e06c8554079968cbe029b8fb010391","observation_id":"4c5acb9e-3ec9-447e-b0f9-eb930e4e8ab7","resolution":{"observed_at":"2026-05-21T18:14:17.558114Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.18137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T20:48:56.478959Z","title":"Spargeattn: Accurate sparse attention accelerating any model inference","venue":null,"work_id":"6199672f-7a6e-41ee-9a53-dcc98d435cb6","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:3f466b94e08ded0252857b99f157b21e666712df926e8a507740dfd3ec1ff5f3","observation_id":"dc54942e-a57a-4fed-a0ae-431fce4c103a","resolution":{"observed_at":"2026-05-21T18:14:17.562800Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04507","last_updated":"2025-06-04T23:21:39Z","snapshot_observed_at":"2026-08-12T05:38:58.830320Z","submitted_at":"2025-02-06T21:17:09Z","title":"Fast Video Generation with Sliding Tile Attention","version":3},"cited_work":{"arxiv_id":"2502.04507","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.04507","snapshot_observed_at":"2026-07-11T01:07:44.493549Z","title":"Spargeattn: Accurate sparse attention accelerat- ing any model inference","venue":"cs.CV","work_id":"c53350cf-72d0-42b0-af6c-8d19e35404e8","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2502.04507","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:bce7d3a6926244e304b338063e231bd7bd6c353966ae5e4c9ba8f046520e2abc","observation_id":"410545fa-cd86-4ed5-ba23-2a5887d4943b","resolution":{"observed_at":"2026-05-21T18:14:17.588344Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hidiffusion: Un- locking higher-resolution creativity and efficiency in pretrained diffusion models","venue":null,"work_id":"472fe193-cbf6-4516-a912-74865d146946","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:0fa10d1b7375f97e0069421d827e726c42dab963455931568e86d456f5180764","observation_id":"a9d4c71a-b750-4465-a75e-b80fe2ea8481","resolution":{"observed_at":"2026-05-21T18:14:17.923254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.05179","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T21:58:58.436623Z","title":"Flashvideo: Flowing fidelity to detail for efficient high-resolution video generation","venue":null,"work_id":"b3a220a0-7017-48ff-8ecc-b8ee16855a09","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:5372fcc9f13115291c33e28f05e07f8452bc5372acbee27d0747c4747e37d791","observation_id":"f5ad65ad-09dc-4620-b961-2eab599ea205","resolution":{"observed_at":"2026-05-21T18:14:17.545727Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.16864","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T22:27:26.259476Z","title":"Training-free efficient video gener- ation via dynamic token carving","venue":null,"work_id":"7b739720-fa30-4330-b5b5-bb401753b77c","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:94ab9f1f9af1440d3af5073c0cfb4d237e649b21257d6b3a56d72a1382786567","observation_id":"73bc8783-7c40-4be2-a9af-ad72399164f1","resolution":{"observed_at":"2026-05-21T18:14:17.579360Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","latest_version":2,"primary_category":"cs.GR","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":29,"verified_fuzzy":19},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2603.21002."}