{"as_of":"2026-08-14T07:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:89e8e0828af70bc7f0cbebb73b47bd88cbb0acbde77728acf877519422a09558","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:44:51.744247Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T18:02:12.529240Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T05:56:40.575048Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21136","snapshot_observed_at":"2026-08-09T18:02:12.529240Z","title":"Sageattention2++: A more efficient implementation of sageattention2","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.00722","last_updated":"2025-06-05T07:54:05Z","snapshot_observed_at":"2026-08-13T12:34:56.799689Z","submitted_at":"2025-02-02T08:44:43Z","title":"Demystifying Cost-Efficiency in LLM Serving over Heterogeneous GPUs","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-09T18:02:12.529240Z"},"links":{"cited_paper":"/paper/2505.21136","citing_paper":"/paper/2502.00722"},"observation_digest":"sha256:92ba15c2332a5c02d38a3299108b2e2b5b5b74feca1071504f2233ef4a6877fe","observation_id":"82ec07e4-dd73-4576-bff2-399298c3707c","resolution":{"observed_at":"2026-08-09T18:02:12.529240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"cited_work":{"arxiv_id":"2505.21136","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21136","snapshot_observed_at":"2026-07-02T05:56:40.575048Z","title":"Sageattention2++: A more efficient implementation of sageattention2","venue":null,"work_id":"af6e3a5a-6c80-47f3-a491-7eddd05d31fd","year":2025},"citing_paper":{"arxiv_id":"2603.28489","last_updated":"2026-07-04T13:25:12Z","snapshot_observed_at":"2026-08-05T11:17:52.410204Z","submitted_at":"2026-03-30T14:23:45Z","title":"Video Generation Models as World Models: Efficient Paradigms, Architectures and Algorithms","version":2},"reference_index":168,"source":"pdf_text","source_observed_at":"2026-05-14T01:35:14.878069Z"},"links":{"cited_paper":"/paper/2505.21136","citing_paper":"/paper/2603.28489"},"observation_digest":"sha256:425974315ce60a2e6ba9ff99d5dfe037801f513c8a78cf521c72f16cd84b357b","observation_id":"bcc02c86-dd4b-43f9-b167-51bcd535b3f7","resolution":{"observed_at":"2026-05-14T01:38:35.811255Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"cited_work":{"arxiv_id":"2505.21136","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21136","snapshot_observed_at":"2026-07-02T05:56:40.575048Z","title":"Sageattention2++: A more efficient implementation of sageattention2","venue":null,"work_id":"af6e3a5a-6c80-47f3-a491-7eddd05d31fd","year":2025},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"cited_paper":"/paper/2505.21136","citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:bcfc6fa054ceed28715561f5a134ef2abe0a77c2827c3411e833170bf08d4c12","observation_id":"6e6122e8-db79-4e63-ae4a-0de51bacf2b4","resolution":{"observed_at":"2026-05-10T06:11:20.055714Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"cited_work":{"arxiv_id":"2505.21136","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21136","snapshot_observed_at":"2026-07-02T05:56:40.575048Z","title":"Sageattention2++: A more efficient implementation of sageattention2","venue":null,"work_id":"af6e3a5a-6c80-47f3-a491-7eddd05d31fd","year":2025},"citing_paper":{"arxiv_id":"2606.06521","last_updated":"2026-06-02T17:29:15Z","snapshot_observed_at":"2026-08-04T10:14:33.744124Z","submitted_at":"2026-06-02T17:29:15Z","title":"P-Cast Precision in FP8 Attention: Sink-Induced Collapse and the Optimality of S=2^8","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T07:55:23.257970Z"},"links":{"cited_paper":"/paper/2505.21136","citing_paper":"/paper/2606.06521"},"observation_digest":"sha256:29108e1029abac306e5c287286ee26ce31db32e33000db79b575307b2c4e298d","observation_id":"97cf3a55-a57c-4d08-8abb-b37110a5a000","resolution":{"observed_at":"2026-07-02T05:56:40.576714Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21136","snapshot_observed_at":"2026-07-12T04:46:57.581402Z","title":"Sageattention2++: A more efficient implementation of sageattention2","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03118","last_updated":"2026-07-21T13:03:04Z","snapshot_observed_at":"2026-08-12T18:56:17.359554Z","submitted_at":"2026-07-03T08:58:06Z","title":"Vidu S1: A Real-Time Interactive Video Generation Model","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-12T04:46:57.581402Z"},"links":{"cited_paper":"/paper/2505.21136","citing_paper":"/paper/2607.03118"},"observation_digest":"sha256:c8c15b522eee9c841d192345bcae2cd32d1f10a7ab8441fd7234420099be346f","observation_id":"44ae696c-bff0-4237-82f5-d00d1d62a645","resolution":{"observed_at":"2026-07-12T04:46:57.581402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21136","snapshot_observed_at":"2026-08-02T08:56:31.582638Z","title":"Sageattention2++: A more efficient implementation of sageattention2","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03118","last_updated":"2026-07-21T13:03:04Z","snapshot_observed_at":"2026-08-12T18:56:17.359554Z","submitted_at":"2026-07-03T08:58:06Z","title":"Vidu S1: A Real-Time Interactive Video Generation Model","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T08:56:31.582638Z"},"links":{"cited_paper":"/paper/2505.21136","citing_paper":"/paper/2607.03118"},"observation_digest":"sha256:757d542187b225b6576b8c2c85ee86eab015abfc7a84375b6126c822437ed58c","observation_id":"c63f6e16-8a37-4f22-ad1a-41449ec5fce3","resolution":{"observed_at":"2026-08-02T08:56:31.582638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21136","snapshot_observed_at":"2026-07-31T16:32:51.991191Z","title":"Sageattention2++: A more efficient implementation of sageattention2,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24377","last_updated":"2026-07-27T12:53:22Z","snapshot_observed_at":"2026-08-13T16:58:15.773596Z","submitted_at":"2026-07-27T12:53:22Z","title":"MXAttention: Data-Free Optimal Scaling and Pre-Normalization Quantization for MXFP4 Attention","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-31T16:32:51.991191Z"},"links":{"cited_paper":"/paper/2505.21136","citing_paper":"/paper/2607.24377"},"observation_digest":"sha256:04106ceb24a66d0dd94573047ae50019e05cfb9a3af74bb8fe23c65e531154b5","observation_id":"21cf43e3-b7df-4e17-9fbe-34d90684c7ad","resolution":{"observed_at":"2026-07-31T16:32:51.991191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21136","snapshot_observed_at":"2026-08-01T02:55:51.477723Z","title":"arXiv preprint arXiv:2505.21136 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25291","last_updated":"2026-08-07T08:55:53Z","snapshot_observed_at":"2026-08-12T23:10:05.069335Z","submitted_at":"2026-07-28T04:57:19Z","title":"CoSA: Accelerating Long-Context Inference via Proxy-Kernel Co-Designed Sparse Attention","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-01T02:55:51.477723Z"},"links":{"cited_paper":"/paper/2505.21136","citing_paper":"/paper/2607.25291"},"observation_digest":"sha256:8d6df79b4a558a40a4bd807a04d11e94632d69d70d9871cb9d51c8465a673a16","observation_id":"be1ed503-9d27-423b-9bbb-e1333006e8f4","resolution":{"observed_at":"2026-08-01T02:55:51.477723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.21136/citation-record","integrity":"/paper/2505.21136/integrity","json":"/paper/2505.21136/citation-record.json","paper":"/paper/2505.21136"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-12T22:21:14.844495Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-07T13:44:50.090294Z","title":"K.-H., Cao, T., Yang, F., and Yang, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:50.090294Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:b670df07cbf676613c3e5b45a41d27618ba51e39970b10b77e9c97e9a3c5aa9c","observation_id":"705ad1c9-c08b-4c17-98bf-479d91723f4e","resolution":{"observed_at":"2026-08-07T13:44:50.090294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:54.047020Z","title":"Clipscore: A reference-free evaluation metric for image captioning","venue":null,"work_id":"4aa7a1be-ebfd-4155-be52-70fcd663a8fc","year":2021},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:50.149148Z"},"links":{"citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:5baa44c585047d73975127affa7219a77506045e6077be11d4690d04e7d6a423","observation_id":"076f52cd-5288-40de-b775-56e45d7e2862","resolution":{"observed_at":"2026-08-07T13:44:54.171901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:53.718654Z","title":null,"venue":null,"work_id":"4d0736eb-f241-49cc-b91c-1c3e62b378f0","year":2014},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:50.444864Z"},"links":{"citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:f702c1e6e3ea85d2dc14613d0d2fb273d395c91063879c7b1df5c3b27e51c8cd","observation_id":"48064749-9225-4a4b-8660-27e4158c5c48","resolution":{"observed_at":"2026-08-07T13:44:53.878740Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.02867","last_updated":"2018-07-28T06:51:27Z","snapshot_observed_at":"2026-08-14T02:17:13.744267Z","submitted_at":"2018-05-08T07:34:17Z","title":"Online normalizer calculation for softmax","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.02867","snapshot_observed_at":"2026-08-07T13:44:50.535682Z","title":"and Gimelshein, N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:50.535682Z"},"links":{"cited_paper":"/paper/1805.02867","citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:c68d35be71ce7162c232f9e1e125aa5608ace3feb3b3b62ea6815f96bf22c448","observation_id":"d62c1c06-be2c-4eba-ba41-6ae6903e2f66","resolution":{"observed_at":"2026-08-07T13:44:50.535682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-07T13:44:50.781089Z","title":"Wan: Open and advanced large-scale video generative models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:50.781089Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:f9ab20cdad9778dd29b0d5459f496e6f24d74d4ff7f7e252ec530b71a14b9b92","observation_id":"1531e2d6-7dce-4ecc-ae04-6867bcba7cfa","resolution":{"observed_at":"2026-08-07T13:44:50.781089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-07T13:44:50.843718Z","title":"Z., Khabsa, M., Fang, H., and Ma, H","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:50.843718Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:f7d28aeb97fa7d7fe804c68f4f327cba0ce0cbd30ad4a525aafa2e4a00eb212f","observation_id":"d2e518b1-72f3-459e-9cb8-76a1d06b320c","resolution":{"observed_at":"2026-08-07T13:44:50.843718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:53.260297Z","title":"Infllm: Training-free long-context extrapolation for llms with an efficient context memory","venue":null,"work_id":"3033a7a5-eddb-438a-bcfe-cf95590eb541","year":2024},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:50.987609Z"},"links":{"citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:05296893c839915e19d458c6347299fd1bd969f1cc9b4064bc47af4f39068d94","observation_id":"9681318e-8a69-4f65-b18c-2883a2e307c8","resolution":{"observed_at":"2026-08-07T13:44:53.344436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06464","last_updated":"2025-03-06T06:57:34Z","snapshot_observed_at":"2026-08-13T23:51:28.504752Z","submitted_at":"2024-12-09T13:09:04Z","title":"Gated Delta Networks: Improving Mamba2 with Delta Rule","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06464","snapshot_observed_at":"2026-08-07T13:44:51.129618Z","title":"Gated delta net- works: Improving mamba2 with delta rule","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:51.129618Z"},"links":{"cited_paper":"/paper/2412.06464","citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:9519a0bf4fcd2c196069aafe1935e3a757068848ab2d850044b7e60beeeb46d8","observation_id":"23d3377f-f866-4474-95ea-fd54adec6cc1","resolution":{"observed_at":"2026-08-07T13:44:51.129618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:51.195790Z","title":"Sageattention2: Efficient attention with thorough outlier smoothing and per-thread int4 quantization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:51.195790Z"},"links":{"citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:4bba661cb5aa3d11c31dfcaa464b6fa53ac68c462a85341347fc0299593f9814","observation_id":"aed44000-4ddb-4930-b5b6-52076bcaf53c","resolution":{"observed_at":"2026-08-07T13:44:51.195790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-07T13:44:51.272498Z","title":"Open-sora: Democratiz- ing efficient video production for all","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:51.272498Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:4f9f31db1bbea0ff2c006410aae9b3fb37c5065d0fba0a7310c96a9009f9f226","observation_id":"2f17af3b-4db9-4100-b373-bcac586d42ff","resolution":{"observed_at":"2026-08-07T13:44:51.272498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:53.072321Z","title":"Text-to-video models are evaluated using the open-sora (Zheng et al.,","venue":null,"work_id":"c8593414-10ec-4a7a-acc2-774b797e1fbc","year":2023},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:51.424063Z"},"links":{"citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:20540cbdeeb85758f74591b7832668bd300264312e9c76cb291ffae572012e7f","observation_id":"024f90a9-c7ed-4614-8813-e9f177f6dff6","resolution":{"observed_at":"2026-08-07T13:44:53.184410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:52.798400Z","title":"Text-to-image models are assessed on COCO annotations (Lin et al., 2014)","venue":null,"work_id":"6282c20f-d730-4871-9beb-7b893d8111dd","year":2014},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:51.517101Z"},"links":{"citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:d4ffa2bd6b088801b76a211ae1b15af4feb3c69da494380a9fb6f307b339f6a0","observation_id":"8f9da372-dd34-4f2d-b2a3-3522af1caeb3","resolution":{"observed_at":"2026-08-07T13:44:52.937859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:52.288414Z","title":"For text-to-image models, generated images are compared with the images in three aspects: FID (Heusel et al.,","venue":null,"work_id":"6b4c9823-1e7e-4b9e-9b7a-ac8cd0efeb09","year":2023},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:51.744247Z"},"links":{"citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:7abaa847c294acabc40d5e46f73338945b031ad258feaedf0ad2274917a80b24","observation_id":"adac5e7d-e069-4e28-9ebe-67413cedfa95","resolution":{"observed_at":"2026-08-07T13:44:52.406675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:52.534897Z","title":"For text-to-video models, following Zhao et al","venue":null,"work_id":"1071c683-0db1-4c4b-8a2a-6911c7cacb17","year":2025},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":1977,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:51.642292Z"},"links":{"citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:80f2a089e859fdc10f6a3df4db2903e8056cdfd4499096b8ad002cd4d4cb58c4","observation_id":"924aa01a-0ec6-4e6b-9ed1-f5ea51a2e218","resolution":{"observed_at":"2026-08-07T13:44:52.629890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04658","last_updated":"2024-01-15T14:57:29Z","snapshot_observed_at":"2026-08-13T04:45:50.150388Z","submitted_at":"2024-01-09T16:27:28Z","title":"Lightning Attention-2: A Free Lunch for Handling Unlimited Sequence Lengths in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04658","snapshot_observed_at":"2026-08-07T13:44:50.687143Z","title":"Lightning attention-2: A free lunch for handling unlim- ited sequence lengths in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:50.687143Z"},"links":{"cited_paper":"/paper/2401.04658","citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:adc2a6b2f91a8dc548409e739ee664cd6d71ce86cda977c3a6eb799befe70ff2","observation_id":"34b89f3c-8c5e-482f-a8a0-c935734b2667","resolution":{"observed_at":"2026-08-07T13:44:50.687143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01901","last_updated":"2025-02-28T07:04:19Z","snapshot_observed_at":"2026-08-10T01:43:44.211509Z","submitted_at":"2025-02-28T07:04:19Z","title":"Identifying Sensitive Weights via Post-quantization Integral","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01901","snapshot_observed_at":"2026-08-07T13:44:50.231009Z","title":"Identifying sensitive weights via post- quantization integral","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:50.231009Z"},"links":{"cited_paper":"/paper/2503.01901","citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:d4498a239d5a8c20ac047e9b8b0d9698c3b9cdc95e03f4d06b0e47cccd600d9f","observation_id":"6dfa40b6-696c-4e32-b3af-9204fd2c8a6d","resolution":{"observed_at":"2026-08-07T13:44:50.231009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-13T14:41:45.809481Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-07T13:44:50.310148Z","title":"Hunyuanvideo: A systematic framework for large video generative models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:50.310148Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:b7f98aa566d58c7c3f24f6133a647352898c6b818fcfcc385f03c38ab0d4c646","observation_id":"70f8dc0e-b2bf-427d-b070-4ed0845d26fe","resolution":{"observed_at":"2026-08-07T13:44:50.310148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T13:44:49.953630Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:49.953630Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:9a6437f414430bb7355db05963fb14cb646d17fd74ba6806b8e1a26ce1c1dbd7","observation_id":"9817bad2-720d-496a-8af5-3299f7608d82","resolution":{"observed_at":"2026-08-07T13:44:49.953630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-13T13:28:15.450370Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-07T13:44:50.914597Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:50.914597Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:2e8825434488348d63d95ad6f70889d871f2191978b9ceeae2901068a684abfb","observation_id":"e310da7f-e507-47da-9b95-4f8ec4dc6b43","resolution":{"observed_at":"2026-08-07T13:44:50.914597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:50.025068Z","title":"Moa: Mixture of sparse attention for automatic large language model compression","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:50.025068Z"},"links":{"citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:068d1317cc31d775df137844a83f3d21d23a9f23bbe5a78965f736fa4c21bbca","observation_id":"7a7221e3-46cb-44b9-a16a-7104eadef4f2","resolution":{"observed_at":"2026-08-07T13:44:50.025068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:53.491934Z","title":"Paperno, D., Kruszewski, G., Lazaridou, A., Pham, N.-Q., Bernardi, R., Pezzelle, S., Baroni, M., Boleda, G., and Fern´andez, R","venue":null,"work_id":"85dc3966-74d6-4003-a460-195497350ec2","year":2025},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:50.606400Z"},"links":{"citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:c9edaed68c9e7dc64b01072611b69165edff24fd2a7b43419edfe19295f862fb","observation_id":"12738bb2-8241-492f-9413-ed5ff783b1ae","resolution":{"observed_at":"2026-08-07T13:44:53.580903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 8 inbound Pith citation observations for arXiv:2505.21136."}