{"as_of":"2026-08-23T10:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:93916a84d3769b23b151e1d699120875aa7003a56f5517ae25f3024c70dbcd4b","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:50:31.128174Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:30:07.774458Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T08:49:41.589584Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"cited_work":{"arxiv_id":"2505.14708","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14708","snapshot_observed_at":"2026-07-04T08:49:41.589584Z","title":"Draftattention: Fast video diffusion via low-resolution attention guidance","venue":null,"work_id":"18f36a2c-524f-4504-87be-6c73cf9cbda3","year":2025},"citing_paper":{"arxiv_id":"2603.18636","last_updated":"2026-05-08T04:13:25Z","snapshot_observed_at":"2026-08-14T21:10:09.483728Z","submitted_at":"2026-03-19T09:00:08Z","title":"Attention Sparsity is Input-Stable: Training-Free Sparse Attention for Video Generation via Offline Sparsity Profiling and Online QK Co-Clustering","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T08:55:52.757489Z"},"links":{"cited_paper":"/paper/2505.14708","citing_paper":"/paper/2603.18636"},"observation_digest":"sha256:1c5fb00a2365508d3e87c5ccc2fa9ebf6609a89339582b214b8a39f3b1d8f547","observation_id":"50e23bfc-c5d3-4358-aabe-afd98c177cb8","resolution":{"observed_at":"2026-05-15T08:59:53.203881Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"cited_work":{"arxiv_id":"2505.14708","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14708","snapshot_observed_at":"2026-07-04T08:49:41.589584Z","title":"Draftattention: Fast video diffusion via low-resolution attention guidance","venue":null,"work_id":"18f36a2c-524f-4504-87be-6c73cf9cbda3","year":2025},"citing_paper":{"arxiv_id":"2604.12219","last_updated":"2026-04-14T02:51:52Z","snapshot_observed_at":"2026-08-18T19:43:52.741784Z","submitted_at":"2026-04-14T02:51:52Z","title":"Ride the Wave: Precision-Allocated Sparse Attention for Smooth Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T15:20:29.350915Z"},"links":{"cited_paper":"/paper/2505.14708","citing_paper":"/paper/2604.12219"},"observation_digest":"sha256:fe40a7d9523b26204f3672e53dc68ff08f57e1bdc49f3a4df729f9c292c03cac","observation_id":"180eb550-7228-4090-ac56-6fe410e950f9","resolution":{"observed_at":"2026-05-11T10:46:02.541898Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"cited_work":{"arxiv_id":"2505.14708","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14708","snapshot_observed_at":"2026-07-04T08:49:41.589584Z","title":"Draftattention: Fast video diffusion via low-resolution attention guidance","venue":null,"work_id":"18f36a2c-524f-4504-87be-6c73cf9cbda3","year":2025},"citing_paper":{"arxiv_id":"2604.15911","last_updated":"2026-04-17T10:11:39Z","snapshot_observed_at":"2026-08-20T15:11:48.430991Z","submitted_at":"2026-04-17T10:11:39Z","title":"Efficient Video Diffusion Models: Advancements and Challenges","version":1},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-05-10T08:28:29.706249Z"},"links":{"cited_paper":"/paper/2505.14708","citing_paper":"/paper/2604.15911"},"observation_digest":"sha256:f5c7dbdb231f5df3234a83454924fa6802b7f47bf495e811611aeebbe5fa13f2","observation_id":"7c887364-5077-4b3d-8792-34b68027c946","resolution":{"observed_at":"2026-05-10T09:03:25.830755Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"cited_work":{"arxiv_id":"2505.14708","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14708","snapshot_observed_at":"2026-07-04T08:49:41.589584Z","title":"Draftattention: Fast video diffusion via low-resolution attention guidance","venue":null,"work_id":"18f36a2c-524f-4504-87be-6c73cf9cbda3","year":2025},"citing_paper":{"arxiv_id":"2604.16592","last_updated":"2026-04-17T17:51:46Z","snapshot_observed_at":"2026-07-06T23:03:52.631613Z","submitted_at":"2026-04-17T17:51:46Z","title":"Human Cognition in Machines: A Unified Perspective of World Models","version":1},"reference_index":151,"source":"pdf_text","source_observed_at":"2026-05-10T08:12:15.663761Z"},"links":{"cited_paper":"/paper/2505.14708","citing_paper":"/paper/2604.16592"},"observation_digest":"sha256:eb559a0769fc451d76148c42bcb1c6672229d43f4334b48d0575effbc5bb58f5","observation_id":"2b99bcc8-7d6c-406a-9745-0c1b1af6d4e4","resolution":{"observed_at":"2026-05-10T08:12:26.203599Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"cited_work":{"arxiv_id":"2505.14708","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14708","snapshot_observed_at":"2026-07-04T08:49:41.589584Z","title":"Draftattention: Fast video diffusion via low-resolution attention guidance","venue":null,"work_id":"18f36a2c-524f-4504-87be-6c73cf9cbda3","year":2025},"citing_paper":{"arxiv_id":"2605.14513","last_updated":"2026-08-09T11:22:36Z","snapshot_observed_at":"2026-08-13T23:28:05.016436Z","submitted_at":"2026-05-14T07:57:55Z","title":"HEART: Exploiting Head Heterogeneity in Sparse Attention for Video Diffusion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T05:17:48.403406Z"},"links":{"cited_paper":"/paper/2505.14708","citing_paper":"/paper/2605.14513"},"observation_digest":"sha256:f14d86e2453ae91bffcb2523f99d7ac15d6379d9af86584c0c05d162e1f73ace","observation_id":"da10acec-124e-4ec7-bb8d-8c6b1dce5c42","resolution":{"observed_at":"2026-05-15T05:19:46.144604Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"cited_work":{"arxiv_id":"2505.14708","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14708","snapshot_observed_at":"2026-07-04T08:49:41.589584Z","title":"Draftattention: Fast video diffusion via low-resolution attention guidance","venue":null,"work_id":"18f36a2c-524f-4504-87be-6c73cf9cbda3","year":2025},"citing_paper":{"arxiv_id":"2605.23445","last_updated":"2026-05-22T09:58:23Z","snapshot_observed_at":"2026-08-03T04:13:05.122168Z","submitted_at":"2026-05-22T09:58:23Z","title":"DFSAttn: Dynamic Fine-grained Sparse Attention for Efficient Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-25T04:44:19.628926Z"},"links":{"cited_paper":"/paper/2505.14708","citing_paper":"/paper/2605.23445"},"observation_digest":"sha256:358cb4776873eda45114979fdf4af1a2cf6365ec04db3b0dff4d54ed8801ba07","observation_id":"6c3d4565-b009-4334-bb60-b7943576a7d3","resolution":{"observed_at":"2026-05-25T04:45:20.079705Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"cited_work":{"arxiv_id":"2505.14708","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14708","snapshot_observed_at":"2026-07-04T08:49:41.589584Z","title":"Draftattention: Fast video diffusion via low-resolution attention guidance","venue":null,"work_id":"18f36a2c-524f-4504-87be-6c73cf9cbda3","year":2025},"citing_paper":{"arxiv_id":"2605.30519","last_updated":"2026-05-28T19:56:00Z","snapshot_observed_at":"2026-08-13T01:14:56.419594Z","submitted_at":"2026-05-28T19:56:00Z","title":"OmniMem: Scalable and Adaptive Memory Retrieval for Long Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T07:56:40.001739Z"},"links":{"cited_paper":"/paper/2505.14708","citing_paper":"/paper/2605.30519"},"observation_digest":"sha256:4557ebe22112ce7c4286fdc942dcea1c3ea82c7e89e938a8906689a892d9a388","observation_id":"a44d3c0f-d115-40fe-bd0d-d46b0f72b286","resolution":{"observed_at":"2026-06-29T08:03:14.480379Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"cited_work":{"arxiv_id":"2505.14708","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14708","snapshot_observed_at":"2026-07-04T08:49:41.589584Z","title":"Draftattention: Fast video diffusion via low-resolution attention guidance","venue":null,"work_id":"18f36a2c-524f-4504-87be-6c73cf9cbda3","year":2025},"citing_paper":{"arxiv_id":"2606.23743","last_updated":"2026-06-24T14:59:15Z","snapshot_observed_at":"2026-08-15T08:01:53.312756Z","submitted_at":"2026-06-21T17:23:20Z","title":"Sol Video Inference Engine: Agent-Native Full-Stack Acceleration Framework for Efficient Video Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T11:05:44.972128Z"},"links":{"cited_paper":"/paper/2505.14708","citing_paper":"/paper/2606.23743"},"observation_digest":"sha256:4c085be5a052c7af4e0a4daf064c667292ae757a32e99f923fcfdca4702fd364","observation_id":"f9ccb5cf-bbe5-4bf6-a3b0-9248869c1a6b","resolution":{"observed_at":"2026-07-04T08:49:41.591210Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"cited_work":{"arxiv_id":"2505.14708","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14708","snapshot_observed_at":"2026-07-04T08:49:41.589584Z","title":"Draftattention: Fast video diffusion via low-resolution attention guidance","venue":null,"work_id":"18f36a2c-524f-4504-87be-6c73cf9cbda3","year":2025},"citing_paper":{"arxiv_id":"2606.29579","last_updated":"2026-06-28T19:48:39Z","snapshot_observed_at":"2026-08-15T18:51:17.430587Z","submitted_at":"2026-06-28T19:48:39Z","title":"ScAle: Attention Head Scaling as a Minimal Adapter for Spatial Reasoning in Vision Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T07:06:36.599771Z"},"links":{"cited_paper":"/paper/2505.14708","citing_paper":"/paper/2606.29579"},"observation_digest":"sha256:ddd8071a433bb3f4f8b9465bb89453189e1bdeee39361cc82a8f84ba2a8d3cb9","observation_id":"3160b14f-1b90-49be-90a6-baa026e53852","resolution":{"observed_at":"2026-06-30T07:14:21.592655Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14708","snapshot_observed_at":"2026-08-15T23:30:07.774458Z","title":"Draftattention: Fast video diffusion via low-resolution attention guidance.arXiv preprint arXiv:2505.14708, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12780","last_updated":"2026-08-13T03:43:31Z","snapshot_observed_at":"2026-08-18T03:59:11.125522Z","submitted_at":"2026-08-13T03:43:31Z","title":"SCOPE: Subspace Clustering with Online Per-Head Top-K Estimation for Sparse Video Attention","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:30:07.774458Z"},"links":{"cited_paper":"/paper/2505.14708","citing_paper":"/paper/2608.12780"},"observation_digest":"sha256:7a718e0ef948371fcac732af127ad7e6bd11bfebc7c17c648836186b6d3dcabc","observation_id":"72a11d85-c79c-4db8-9df3-262c0d805b44","resolution":{"observed_at":"2026-08-15T23:30:07.774458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14708/citation-record","integrity":"/paper/2505.14708/integrity","json":"/paper/2505.14708/citation-record.json","paper":"/paper/2505.14708"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2212.09748","last_updated":"2023-03-02T09:06:55Z","snapshot_observed_at":"2026-08-17T19:22:44.145403Z","submitted_at":"2022-12-19T18:59:58Z","title":"Scalable Diffusion Models with Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09748","snapshot_observed_at":"2026-08-15T20:50:30.965145Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:30.965145Z"},"links":{"cited_paper":"/paper/2212.09748","citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:7a691f23ff274c3d9df163dd54fac4db3a50e22fbcbcd03e8aaeb9e167c5b8bd","observation_id":"6f3de4da-0692-434a-b28c-49db220f22d3","resolution":{"observed_at":"2026-08-15T20:50:30.965145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:30.971477Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:30.971477Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:1f2fb257b7b866ea0450471fccaab95bddbba3f448d3699b21b401e8206af22e","observation_id":"493da4af-714f-4c56-a5f6-0af4716de24a","resolution":{"observed_at":"2026-08-15T20:50:30.971477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:30.976331Z","title":"Vivit: A video vision transformer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:30.976331Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:254a147337a25986efcc670694c66ee91c72b87a8de6a71e07b3ffe8239c154f","observation_id":"f092d995-d094-4e59-bce4-54d380b7f480","resolution":{"observed_at":"2026-08-15T20:50:30.976331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-08-15T19:52:28.153954Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-15T20:50:30.981199Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:30.981199Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:ef72e840e5177deb580cca90fe9e2cb52cbe957c7a33a30fe5a25d5142f73f1c","observation_id":"22c293a0-a376-46c8-92e2-ef4bd4a4a13e","resolution":{"observed_at":"2026-08-15T20:50:30.981199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.735533Z","title":"Hunyuanvideo: A systematic framework for large video generative models, 2024","venue":null,"work_id":"8975c387-d808-4f24-8ff3-1d9bb925d89a","year":2024},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:30.986690Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:ec3926f2db13d9af8f030006fc5cc27bcaa885721f5a84624dcda5a3eec86d40","observation_id":"a576ba34-5e96-474b-8039-b95c335e99b0","resolution":{"observed_at":"2026-08-15T20:50:31.740510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-15T20:50:30.991891Z","title":"Wan: Open and advanced large-scale video generative models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:30.991891Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:6fce241c5cb04fc84b50456471164e50bb7a4edb336ffec6ba530c1b83690fd6","observation_id":"512e13d4-3656-4bc6-81fd-d15ebfc023fe","resolution":{"observed_at":"2026-08-15T20:50:30.991891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:30.998274Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher Ré","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:30.998274Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:2b5cea914eac3efc2e2adda344f4ab3d39c99ad9dcbea2e9491dca4b3bb95ca1","observation_id":"2e52d95b-c36e-425d-950f-9fd80e99bf8f","resolution":{"observed_at":"2026-08-15T20:50:30.998274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.707642Z","title":"H2o: Heavy-hitter oracle for efficient generative inference of large language models","venue":null,"work_id":"f36b9841-aa8d-4695-a943-9a3d0976d751","year":2023},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.003413Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:bb654e902fb2a317d38f8023799aea02499707a2c77f66c088f2ced07e58b5fa","observation_id":"4424cb08-a267-4ccb-bc75-e7961949bd5f","resolution":{"observed_at":"2026-08-15T20:50:31.713196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.691529Z","title":"Quest: Query-aware sparsity for efficient long-context llm inference, 2024","venue":null,"work_id":"81955437-acbd-41d2-bcd8-916dd7a5fbee","year":2024},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.008271Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:bd05c2d0707d4a41413f0bd37a39b95e7b6336966e337e0d442a9c18b97602d2","observation_id":"29d1818c-bd04-4dca-b308-b1fcfde7eeaf","resolution":{"observed_at":"2026-08-15T20:50:31.696572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.013079Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.013079Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:2339dd7e11beef0159e33c16ce3cf5f9f29e109ad8575ea501a588733418ef45","observation_id":"24772265-a706-4805-aac2-7f1ef18fc6f6","resolution":{"observed_at":"2026-08-15T20:50:31.013079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.662138Z","title":"Abdi, Dongsheng Li, Chin-Yew Lin, Yuqing Yang, and Lili Qiu","venue":null,"work_id":"f82a0f9b-9023-44dc-9fb2-39a3868040e1","year":2024},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.017734Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:782c186b6b466a48ccf70714b582841853df38688298770f43efe546e2b7beb8","observation_id":"9d52f5fc-395b-4627-9971-5e8ac040f980","resolution":{"observed_at":"2026-08-15T20:50:31.667615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.645644Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":"9d85b54d-ccf3-4c01-91ee-8c0759b7b846","year":2019},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.022312Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:be45ab9605b5aa104050e4c240ca06070eef0b560b124e5273a1ff6db38ac0c2","observation_id":"412910e7-a262-43b5-92e2-381847fc861e","resolution":{"observed_at":"2026-08-15T20:50:31.650692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-15T20:50:31.027495Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.027495Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:6466b52495db48b53c396c3895e481bc1e959bc389de5c8b399c188d52c8ba16","observation_id":"de03da2c-88b1-49e8-be49-bf062c0ad3f7","resolution":{"observed_at":"2026-08-15T20:50:31.027495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-15T20:50:31.032615Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.032615Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:e6f1d9bd41a7cda539b614a13a38cc14dad3d496c999ef747097a5741a559257","observation_id":"6d3f8f8f-4d9b-437d-b10b-5cd4528da883","resolution":{"observed_at":"2026-08-15T20:50:31.032615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T20:50:31.037606Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.037606Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:f5af164e0b6bb13b22674d3fd9d6220353dd07d110bf17e12b9d9de1b5d6e4ef","observation_id":"687329a7-687a-43ea-a736-77a82c2c45df","resolution":{"observed_at":"2026-08-15T20:50:31.037606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-16T05:47:34.106216Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-15T20:50:31.042863Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.042863Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:030d1aa793ace14537c3002feca9b82243b70dd1777795f9690171965831623e","observation_id":"597935ef-4702-4e8c-b2f5-bb0c2900a916","resolution":{"observed_at":"2026-08-15T20:50:31.042863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.21079","last_updated":"2025-02-28T14:11:20Z","snapshot_observed_at":"2026-08-16T12:54:16.344181Z","submitted_at":"2025-02-28T14:11:20Z","title":"Training-free and Adaptive Sparse Attention for Efficient Long Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.21079","snapshot_observed_at":"2026-08-15T20:50:31.048052Z","title":"Training-free and adaptive sparse attention for efficient long video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.048052Z"},"links":{"cited_paper":"/paper/2502.21079","citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:bd4bc06479bab8cca4ff472755a2baa24088b309db404f3cc55adbf1da0e431d","observation_id":"4cb213a9-7a32-433a-a981-7d6f6409ecc6","resolution":{"observed_at":"2026-08-15T20:50:31.048052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.052823Z","title":"Block Sparse Attention","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.052823Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:6f1f698084b43a806f04941249c9cd992718d73db92fe67cf8b9001347cf3b5b","observation_id":"59dc8912-081c-490d-a5d9-a1b6f3e46a44","resolution":{"observed_at":"2026-08-15T20:50:31.052823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.619487Z","title":"Q-diffusion: Quantizing diffusion models","venue":null,"work_id":"b31e877d-c0a9-4186-ab9b-86ac7f786bc4","year":2023},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.057507Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:b57405e78170a890e9ce083bd6db55536361a126c8de2c546aa1b2eef11a4176","observation_id":"961c7a2d-26af-45d4-9584-5dcc57c83b39","resolution":{"observed_at":"2026-08-15T20:50:31.624441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.602906Z","title":"Sageattention: Accurate 8-bit attention for plug-and-play inference acceleration","venue":null,"work_id":"836a7cc7-1ec9-43c9-a4f9-a05b36068a5f","year":2025},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.062262Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:fd87aae4135ccda090c824ed4f7495534dd5dfeadf6f8ecb4ffa6fe3ee8b52b5","observation_id":"e90f4b9d-ed5e-4411-a1c6-950cd3ee37b0","resolution":{"observed_at":"2026-08-15T20:50:31.608210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.586181Z","title":"Sageatten- tion2: Efficient attention with thorough outlier smoothing and per-thread int4 quantization","venue":null,"work_id":"4b542405-4526-41c1-9e78-9104101999a4","year":2025},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.067099Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:3effe93efe2157dd7e8425b653e23d5551437e07d450c5e8bef59f25e743b94e","observation_id":"99e64d2e-afde-414d-82f3-61f5b1a06155","resolution":{"observed_at":"2026-08-15T20:50:31.591431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.071830Z","title":"Svdquant: Absorbing outliers by low-rank components for 4-bit diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.071830Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:7c6d353719c95258ce6871ff00dcc8fb6c7f6303e8dd1113efc20990c7d2305c","observation_id":"e22102af-95e1-494e-9a89-828e3895b042","resolution":{"observed_at":"2026-08-15T20:50:31.071830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.076330Z","title":"SANA: Efficient high-resolution text-to-image synthesis with linear diffusion transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.076330Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:f4103cc9d837c0407fbbabe3fbb10fe4428697dae03bbd8dcaafbcaef2e6b614","observation_id":"c0580a01-4866-4907-9945-ebefb0a0366b","resolution":{"observed_at":"2026-08-15T20:50:31.076330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.549229Z","title":"Deep compression autoencoder for efficient high-resolution diffusion models","venue":null,"work_id":"45d997ce-8a98-40f4-adc2-4022fcee478e","year":2025},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.080880Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:8ac900d33efaa92ad109ce65ffa35d220c03b4027330327fd426b11f0796790f","observation_id":"b28a0591-054b-47ff-8f09-2bc21f72aa48","resolution":{"observed_at":"2026-08-15T20:50:31.554348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.533127Z","title":"Snapfusion: Text-to-image diffusion model on mobile devices within two seconds","venue":null,"work_id":"96cff80b-6d44-4c3b-a302-058631d9744f","year":2023},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.085688Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:16cf5a0ca475517e981aac2d17491da08aff5dff976bec66e67eeec6bc1b8fa5","observation_id":"c716df06-ed97-407a-8934-e3af949a710b","resolution":{"observed_at":"2026-08-15T20:50:31.538166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.090253Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.090253Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:f56ca3bcfe1ce60baedb7ef96117cd487e14164e6bbbd5cb649c167af2ba46bc","observation_id":"5c0f02b2-4f81-4183-ab62-25a98edae6d3","resolution":{"observed_at":"2026-08-15T20:50:31.090253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.10509","last_updated":"2019-04-23T19:29:47Z","snapshot_observed_at":"2026-08-16T10:03:03.268538Z","submitted_at":"2019-04-23T19:29:47Z","title":"Generating Long Sequences with Sparse Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.10509","snapshot_observed_at":"2026-08-15T20:50:31.094913Z","title":"Generating long sequences with sparse transformers","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.094913Z"},"links":{"cited_paper":"/paper/1904.10509","citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:bf6120a591bad36f0cd9717a1a382703039931d353f82f5bae6c0b32e12a2a4a","observation_id":"85484885-488b-4a8c-8243-fdbeeae1fc99","resolution":{"observed_at":"2026-08-15T20:50:31.094913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.504200Z","title":"Duoattention: Efficient long-context LLM inference with retrieval and streaming heads","venue":null,"work_id":"2528cb9a-a5fd-4fae-af3b-53d91c6768a1","year":2025},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.099672Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:9dfd0edd457957d77bbc8e4284cacfaaf9d4337899f5053b5c652190cc531236","observation_id":"7d3f0099-cf8a-4be4-92c9-346f8259db42","resolution":{"observed_at":"2026-08-15T20:50:31.510435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16428","last_updated":"2025-03-20T17:59:58Z","snapshot_observed_at":"2026-08-16T12:48:10.527009Z","submitted_at":"2025-03-20T17:59:58Z","title":"XAttention: Block Sparse Attention with Antidiagonal Scoring","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16428","snapshot_observed_at":"2026-08-15T20:50:31.104438Z","title":"Xattention: Block sparse attention with antidiagonal scoring","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.104438Z"},"links":{"cited_paper":"/paper/2503.16428","citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:896a8401c2c6e00c71b0c4d7e9dba214c2a737c38c55b97fccb59e491f2353db","observation_id":"9e154d41-5717-4ca3-aacd-d8873b40a9f1","resolution":{"observed_at":"2026-08-15T20:50:31.104438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.487566Z","title":"Distrifusion: Distributed parallel inference for high-resolution diffusion models","venue":null,"work_id":"8adeb1d9-a6f4-49be-a4bc-a26f1c5be6f7","year":2024},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.109702Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:8b375251205a82e2bf43e6f6059cd61494787a67e4cb794c0424b1478c7be132","observation_id":"ee4e5578-9194-4214-bf70-f0d09f4a9abe","resolution":{"observed_at":"2026-08-15T20:50:31.492756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.114338Z","title":"Svdqunat: Absorbing outliers by low-rank components for 4-bit diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.114338Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:3e85716d8f3f178fbd9f269c6df6fed0a9f830a615d44e92692d89c6ca8c7a84","observation_id":"76c31ee4-b838-4783-b1a6-e6b412a0e4f3","resolution":{"observed_at":"2026-08-15T20:50:31.114338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.118995Z","title":"Timestep embedding tells: It’s time to cache for video diffusion model, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.118995Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:4c88e83b7085a74c6fc9ba21010978ea00f11b42236f5f9a023da244e8a5d54c","observation_id":"00bfca70-7b8c-44b5-9cdb-50f3ed11287b","resolution":{"observed_at":"2026-08-15T20:50:31.118995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.123644Z","title":"VBench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.123644Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:8f98e51dbb633a5d07874b76845c0c56e7a1f613cf3ed7c4ad241cce9328216d","observation_id":"419b60f1-e004-4429-985a-74b444da528f","resolution":{"observed_at":"2026-08-15T20:50:31.123644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:50:31.447609Z","title":"The unreason- able effectiveness of deep features as a perceptual metric","venue":null,"work_id":"75fb6d2a-ea56-43bd-89c1-ac92bc65f5f6","year":2018},"citing_paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:50:31.128174Z"},"links":{"citing_paper":"/paper/2505.14708"},"observation_digest":"sha256:cf0e2b88cb91949a37a7cb3d7e242cc2c438c9797a5044921d4363abe9230c3f","observation_id":"584c3368-9945-4976-8870-65db8930f688","resolution":{"observed_at":"2026-08-15T20:50:31.454496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.14708","last_updated":"2025-05-17T04:34:34Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T20:44:37.695776Z","submitted_at":"2025-05-17T04:34:34Z","title":"DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 10 inbound Pith citation observations for arXiv:2505.14708."}