{"as_of":"2026-08-12T19:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:60f4f8086c312bc89e96f77b8c33da9a3e46654995aad3192365fce212e65c07","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:20:08.241880Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T14:40:20.517450Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T14:43:22.566970Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"cited_work":{"arxiv_id":"2510.16325","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.16325","snapshot_observed_at":"2026-06-30T02:16:10.668452Z","title":"Scale-dit: Ultra-high- resolution image generation with hierarchical local attention","venue":null,"work_id":"87062d27-be79-48fc-bbad-7ce2781576bb","year":2025},"citing_paper":{"arxiv_id":"2605.17294","last_updated":"2026-05-17T07:14:15Z","snapshot_observed_at":"2026-08-12T07:31:46.490159Z","submitted_at":"2026-05-17T07:14:15Z","title":"HierEdit: Region-Aware Hierarchical Diffusion for Efficient High-Resolution Editing","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-20T14:40:20.517450Z"},"links":{"cited_paper":"/paper/2510.16325","citing_paper":"/paper/2605.17294"},"observation_digest":"sha256:f0855fdc30cefa2cb8b3f3643fa4a9f2e9e5d795b20c214faa12377e5a831215","observation_id":"648cb113-d744-48ea-a9e0-9559df6ccef5","resolution":{"observed_at":"2026-06-30T02:16:10.668452Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2510.16325/citation-record","integrity":"/paper/2510.16325/integrity","json":"/paper/2510.16325/citation-record.json","paper":"/paper/2510.16325"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-04T09:20:06.007749Z","title":"Longformer: The long-document transformer","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:06.007749Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:9abad6c30a61f3a7e19f6d451a205e6533e82250a59f8ed685209ad7453638c8","observation_id":"932c00b0-18dd-4e88-9c09-d2385501d9fd","resolution":{"observed_at":"2026-08-04T09:20:06.007749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22705","last_updated":"2025-05-28T17:59:15Z","snapshot_observed_at":"2026-07-30T00:45:52.058972Z","submitted_at":"2025-05-28T17:59:15Z","title":"HiDream-I1: A High-Efficient Image Generative Foundation Model with Sparse Diffusion Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22705","snapshot_observed_at":"2026-08-04T09:20:06.234576Z","title":"Hidream-i1: A high-efficient image generative foundation model with sparse diffusion transformer.arXiv preprint arXiv:2505.22705,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:06.234576Z"},"links":{"cited_paper":"/paper/2505.22705","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:1ec9ab944e9cf71a6b8f249e6b064f973d7d7b32bda1eaf6f0fe9eaf0070a49e","observation_id":"9b18dbe6-2c68-4586-ba19-f00166c990ec","resolution":{"observed_at":"2026-08-04T09:20:06.234576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-04T09:20:06.351589Z","title":"Pixart-α: Fast training of diffusion transformer for photore- alistic text-to-image synthesis.arXiv preprint arXiv:2310.00426,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:06.351589Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:a22e6a3d49088cc5b390e188c5dec722f9218c8d0257acf7dfd5189c89a4f4c0","observation_id":"ef53952c-9f71-4539-a38c-60627b0dc3be","resolution":{"observed_at":"2026-08-04T09:20:06.351589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20766","last_updated":"2025-02-28T06:34:53Z","snapshot_observed_at":"2026-08-07T17:40:46.337382Z","submitted_at":"2025-02-28T06:34:53Z","title":"FlexPrefill: A Context-Aware Sparse Attention Mechanism for Efficient Long-Sequence Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20766","snapshot_observed_at":"2026-08-04T09:20:06.613749Z","title":"Flexprefill: A context-aware sparse attention mechanism for efficient long-sequence inference.arXiv preprint arXiv:2502.20766,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:06.613749Z"},"links":{"cited_paper":"/paper/2502.20766","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:d74b561d8ba454f5765130ac431617912e263c0fbab63e126ff940c11bb77c08","observation_id":"041c5d06-2132-4dee-89d7-aaed139c5a31","resolution":{"observed_at":"2026-08-04T09:20:06.613749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17245","last_updated":"2024-02-27T06:31:52Z","snapshot_observed_at":"2026-07-06T17:36:01.939242Z","submitted_at":"2024-02-27T06:31:52Z","title":"Playground v2.5: Three Insights towards Enhancing Aesthetic Quality in Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17245","snapshot_observed_at":"2026-08-04T09:20:06.722617Z","title":"Playground v2","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:06.722617Z"},"links":{"cited_paper":"/paper/2402.17245","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:73f098475a7e8f3f7a15bb8edfda11db82b42320ef2af51b9a6da3221d0bef35","observation_id":"870eade0-3460-4988-ad84-234f02bdce3b","resolution":{"observed_at":"2026-08-04T09:20:06.722617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15061","last_updated":"2025-03-04T07:00:07Z","snapshot_observed_at":"2026-08-12T09:08:23.852325Z","submitted_at":"2025-01-25T03:46:35Z","title":"PolaFormer: Polarity-aware Linear Attention for Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15061","snapshot_observed_at":"2026-08-04T09:20:07.041132Z","title":"Polaformer: Polarity-aware linear attention for vision transformers.arXiv preprint arXiv:2501.15061,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:07.041132Z"},"links":{"cited_paper":"/paper/2501.15061","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:5afc2ce0e6d6e7ff47714aac11cc911b0f5fa8fd4c43a4e9a002858869923de2","observation_id":"144b3453-136f-451b-bc1d-609bdf09ad68","resolution":{"observed_at":"2026-08-04T09:20:07.041132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-04T09:20:07.195558Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis.arXiv preprint arXiv:2307.01952,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:07.195558Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:74d834d208d7af263b9e8acfc8fdc33250cef568ea3aef575932451a233e12c2","observation_id":"2c8f7331-3c53-46e0-bd94-e1ad0565aa00","resolution":{"observed_at":"2026-08-04T09:20:07.195558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09626","last_updated":"2025-07-11T09:08:46Z","snapshot_observed_at":"2026-08-11T16:49:05.253861Z","submitted_at":"2024-12-12T18:59:59Z","title":"FreeScale: Unleashing the Resolution of Diffusion Models via Tuning-Free Scale Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09626","snapshot_observed_at":"2026-08-04T09:20:07.251023Z","title":"Freescale: Unleashing the resolution of diffusion models via tuning-free scale fusion.arXiv preprint arXiv:2412.09626,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:07.251023Z"},"links":{"cited_paper":"/paper/2412.09626","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:431f3b2282a73856afd2789e1bb8bcfae9ad68556d8366a1668a6653caa6ec8a","observation_id":"84494b1a-9ecc-4a22-bf2f-e3fc63f7f581","resolution":{"observed_at":"2026-08-04T09:20:07.251023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-10T06:09:21.088224Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-04T09:20:07.411349Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:07.411349Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:eb9009805d970c4a06f6816b5df67f12f3a03fe2c350a673ec7a4ae53224de33","observation_id":"fc7f59fe-43c7-43d8-aebd-faa67ca10143","resolution":{"observed_at":"2026-08-04T09:20:07.411349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10629","last_updated":"2024-10-20T14:35:31Z","snapshot_observed_at":"2026-07-06T19:33:08.264958Z","submitted_at":"2024-10-14T15:36:42Z","title":"SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10629","snapshot_observed_at":"2026-08-04T09:20:07.526556Z","title":"Enze Xie, Junsong Chen, Yuyang Zhao, Jincheng Yu, Ligeng Zhu, Chengyue Wu, Yujun Lin, Zhekai Zhang, Muyang Li, Junyu Chen, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:07.526556Z"},"links":{"cited_paper":"/paper/2410.10629","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:0f1d1ceb20e94543c671c381a1d2974b08b4bc85b4d6278f14b8da18a5889082","observation_id":"0a15cec0-087f-4439-bbab-1943028ed0fc","resolution":{"observed_at":"2026-08-04T09:20:07.526556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16428","last_updated":"2025-03-20T17:59:58Z","snapshot_observed_at":"2026-08-07T16:48:20.217813Z","submitted_at":"2025-03-20T17:59:58Z","title":"XAttention: Block Sparse Attention with Antidiagonal Scoring","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16428","snapshot_observed_at":"2026-08-04T09:20:07.600476Z","title":"Xattention: Block sparse attention with antidiagonal scoring.arXiv preprint arXiv:2503.16428,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:07.600476Z"},"links":{"cited_paper":"/paper/2503.16428","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:1dd903b75752bca14b48f42baf1721b90facad08c4051047fdc6e3ffa5ac13f0","observation_id":"5bd030a1-7d24-415d-9aa4-259401d341ae","resolution":{"observed_at":"2026-08-04T09:20:07.600476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-08-04T09:20:07.773723Z","title":"Sparse videogen2: Accelerate video generation with sparse attention via semantic-aware permutation.arXiv preprint arXiv:2505.18875,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:07.773723Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:c374c20776bb31a9f652ccb6815709db64fa8f6b4d63d2efe85328b8fd66b789","observation_id":"a98bc80e-4815-4f0c-8dd3-b515437ca70b","resolution":{"observed_at":"2026-08-04T09:20:07.773723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16322","last_updated":"2025-03-20T16:44:43Z","snapshot_observed_at":"2026-08-12T07:07:56.463781Z","submitted_at":"2025-03-20T16:44:43Z","title":"Ultra-Resolution Adaptation with Ease","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16322","snapshot_observed_at":"2026-08-04T09:20:07.888542Z","title":"Under review","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:07.888542Z"},"links":{"cited_paper":"/paper/2503.16322","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:168f307d1396569df2b48c027cfa70a3db76a088e0c2759e71553772b96d21da","observation_id":"e136a488-71f9-46b5-b5fc-95dfc93455f4","resolution":{"observed_at":"2026-08-04T09:20:07.888542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.22796","last_updated":"2025-03-28T18:00:12Z","snapshot_observed_at":"2026-08-07T16:29:25.217332Z","submitted_at":"2025-03-28T18:00:12Z","title":"DiTFastAttnV2: Head-wise Attention Compression for Multi-Modality Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.22796","snapshot_observed_at":"2026-08-04T09:20:07.977364Z","title":"Ditfastattnv2: Head-wise attention compression for multi-modality diffusion transformers.arXiv preprint arXiv:2503.22796, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:07.977364Z"},"links":{"cited_paper":"/paper/2503.22796","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:0d777fb174aa436bc187a44c12470adc62056615dcd713720d52ffa2b55549cc","observation_id":"42feef2d-24e6-4fe5-83cb-7bd4c4fe05be","resolution":{"observed_at":"2026-08-04T09:20:07.977364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04347","last_updated":"2024-02-06T19:31:26Z","snapshot_observed_at":"2026-08-07T03:58:02.059388Z","submitted_at":"2024-02-06T19:31:26Z","title":"The Hedgehog & the Porcupine: Expressive Linear Attentions with Softmax Mimicry","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04347","snapshot_observed_at":"2026-08-04T09:20:08.097591Z","title":"The hedgehog & the porcupine: Expressive linear attentions with softmax mimicry, 2024b.URL https://arxiv","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:08.097591Z"},"links":{"cited_paper":"/paper/2402.04347","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:1f7993d9169cce3c604d54758bcf3711b18c84238e3d5ad328260b0d715dd2d7","observation_id":"bfb91ebf-b9f2-4f2c-9600-40707c4d24fe","resolution":{"observed_at":"2026-08-04T09:20:08.097591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:20:08.241880Z","title":"Our method is in leading position across all metrics","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:08.241880Z"},"links":{"citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:21a0c8cb40d21bae93edfc7ebcde18e2996245d8ee24992eeac4980474724541","observation_id":"5a9ca147-f3bf-4c0e-ae26-bf3b043c1942","resolution":{"observed_at":"2026-08-04T09:20:08.241880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15742","last_updated":"2025-06-24T05:31:03Z","snapshot_observed_at":"2026-08-10T10:43:25.582099Z","submitted_at":"2025-06-17T20:18:23Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.15742","snapshot_observed_at":"2026-08-04T09:20:06.061301Z","title":"Flux.1 kontext: Flow matching for in-context image generation and editing in latent space.arXiv preprint arXiv:2506.15742,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:06.061301Z"},"links":{"cited_paper":"/paper/2506.15742","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:1af80f9b2dd6f215afb5acdb46a18835f4bc7cf73da4947a1f3550017b79e882","observation_id":"3f227d34-0c3d-4255-a5bb-4cb432dc0a98","resolution":{"observed_at":"2026-08-04T09:20:06.061301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11346","last_updated":"2025-06-28T11:46:35Z","snapshot_observed_at":"2026-07-06T21:09:50.780345Z","submitted_at":"2025-04-15T16:19:07Z","title":"Seedream 3.0 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11346","snapshot_observed_at":"2026-08-04T09:20:06.525522Z","title":"Demofusion: Democratising high-resolution image generation with no $$$","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:06.525522Z"},"links":{"cited_paper":"/paper/2504.11346","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:d7b4a2f581f4a80d379c266d2208eba5a27a7169cb9461ce0300ef7c8c993054","observation_id":"5fe55a0e-1aaa-4385-a23c-50df94524068","resolution":{"observed_at":"2026-08-04T09:20:06.525522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02097","last_updated":"2024-10-17T08:09:37Z","snapshot_observed_at":"2026-08-09T17:41:45.360146Z","submitted_at":"2024-09-03T17:54:39Z","title":"LinFusion: 1 GPU, 1 Minute, 16K Image","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02097","snapshot_observed_at":"2026-08-04T09:20:06.875247Z","title":"Linfusion: 1 gpu, 1 minute, 16k image.arXiv preprint arXiv:2409.02097, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:06.875247Z"},"links":{"cited_paper":"/paper/2409.02097","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:42363a6bd1f6c7b19df9e0f94a488adf2d3952fbf666987c64f455a5a7870aba","observation_id":"6bbafdf3-6dff-4da1-ac68-89a60b371c21","resolution":{"observed_at":"2026-08-04T09:20:06.875247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05252","last_updated":"2024-01-10T16:27:38Z","snapshot_observed_at":"2026-08-11T02:40:47.256553Z","submitted_at":"2024-01-10T16:27:38Z","title":"PIXART-{\\delta}: Fast and Controllable Image Generation with Latent Consistency Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05252","snapshot_observed_at":"2026-08-04T09:20:06.446325Z","title":"Pixart-σ: Weak-to-strong training of diffusion transformer for 4k text-to-image generation, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:06.446325Z"},"links":{"cited_paper":"/paper/2401.05252","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:4c3d7da724109ee4845a3abd1149f29c7475bf1572d885b49c1be2a6726a6800","observation_id":"b9524794-c284-4117-ab34-f0b0ba46ae24","resolution":{"observed_at":"2026-08-04T09:20:06.446325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03350","last_updated":"2023-09-04T15:00:33Z","snapshot_observed_at":"2026-08-10T01:54:02.067073Z","submitted_at":"2023-09-04T15:00:33Z","title":"Relay Diffusion: Unifying diffusion process across resolutions for image synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03350","snapshot_observed_at":"2026-08-04T09:20:07.298311Z","title":"Relay diffusion: Unifying diffusion process across resolutions for image synthesis.arXiv preprint arXiv:2309.03350,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:07.298311Z"},"links":{"cited_paper":"/paper/2309.03350","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:4f90a701d10229ec47ff8f75e82597f44542f9767238171ebeb920cc43109bf1","observation_id":"d763430c-71b2-4c20-8c06-732094edf097","resolution":{"observed_at":"2026-08-04T09:20:07.298311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06232","last_updated":"2025-05-16T13:11:45Z","snapshot_observed_at":"2026-08-12T14:05:56.735380Z","submitted_at":"2025-04-08T17:30:40Z","title":"HiFlow: Training-free High-Resolution Image Generation with Flow-Aligned Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.06232","snapshot_observed_at":"2026-08-04T09:20:06.151128Z","title":"Hiflow: Training-free high-resolution image generation with flow-aligned guidance.arXiv preprint arXiv:2504.06232,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:06.151128Z"},"links":{"cited_paper":"/paper/2504.06232","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:982cd928acb6851941bed763464d2e8c364388ffef43cbb85971cf81629b79fb","observation_id":"5a2785cf-b1a2-4737-b366-57c15ce2e4ca","resolution":{"observed_at":"2026-08-04T09:20:06.151128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 1 inbound Pith citation observation for arXiv:2510.16325."}