{"as_of":"2026-08-10T18:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b269bac2ea81d98bf45f0e1b1cb4eea91bac2301c6418a66e58b7a36dc4fe4e0","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T17:16:43.672571Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T18:13:48.401465Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.02097","last_updated":"2024-10-17T08:09:37Z","snapshot_observed_at":"2026-08-09T17:41:45.360146Z","submitted_at":"2024-09-03T17:54:39Z","title":"LinFusion: 1 GPU, 1 Minute, 16K Image","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02097","snapshot_observed_at":"2026-08-10T17:16:43.672571Z","title":"Linfusion: 1 gpu, 1 minute, 16k image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.672571Z"},"links":{"cited_paper":"/paper/2409.02097","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:46c98e9e2fac6c2148950a19f1eaedb6d0bcca2340aa4b7dd16209609d933f4a","observation_id":"fa2c8bcd-df98-43d8-a1c8-066f1b21ff69","resolution":{"observed_at":"2026-08-10T17:16:43.672571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02097","last_updated":"2024-10-17T08:09:37Z","snapshot_observed_at":"2026-08-09T17:41:45.360146Z","submitted_at":"2024-09-03T17:54:39Z","title":"LinFusion: 1 GPU, 1 Minute, 16K Image","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02097","snapshot_observed_at":"2026-08-09T17:07:38.320756Z","title":"Liu, S., Yu, W., Tan, Z., and Wang, X","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.00972","last_updated":"2025-02-03T00:51:09Z","snapshot_observed_at":"2026-08-09T17:41:23.224574Z","submitted_at":"2025-02-03T00:51:09Z","title":"Pushing the Boundaries of State Space Models for Image and Video Generation","version":1},"reference_index":755,"source":"pdf_text","source_observed_at":"2026-08-09T17:07:38.320756Z"},"links":{"cited_paper":"/paper/2409.02097","citing_paper":"/paper/2502.00972"},"observation_digest":"sha256:569814bedeb3917774790dedccd9bf64e17bbaf413216716b92608fb89a1ead5","observation_id":"175fa8c8-19da-46bc-96bb-62737264b31c","resolution":{"observed_at":"2026-08-09T17:07:38.320756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02097","last_updated":"2024-10-17T08:09:37Z","snapshot_observed_at":"2026-08-09T17:41:45.360146Z","submitted_at":"2024-09-03T17:54:39Z","title":"LinFusion: 1 GPU, 1 Minute, 16K Image","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02097","snapshot_observed_at":"2026-08-07T14:03:17.907050Z","title":"Linfusion: 1 gpu, 1 minute, 16k image.arXiv preprint arXiv:2409.02097, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20171","last_updated":"2025-05-26T16:12:41Z","snapshot_observed_at":"2026-08-10T14:47:31.651213Z","submitted_at":"2025-05-26T16:12:41Z","title":"Long-Context State-Space Video World Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:17.907050Z"},"links":{"cited_paper":"/paper/2409.02097","citing_paper":"/paper/2505.20171"},"observation_digest":"sha256:e2f275f54a2047a51b2d41bcaa28068d4cfe784eea7340c0e3e8326925d25d11","observation_id":"07f81108-c6cd-481c-b297-ffa44504f9ba","resolution":{"observed_at":"2026-08-07T14:03:17.907050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02097","last_updated":"2024-10-17T08:09:37Z","snapshot_observed_at":"2026-08-09T17:41:45.360146Z","submitted_at":"2024-09-03T17:54:39Z","title":"LinFusion: 1 GPU, 1 Minute, 16K Image","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02097","snapshot_observed_at":"2026-08-07T10:28:39.512049Z","title":"Linfusion: 1 gpu, 1 minute, 16k image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05284","last_updated":"2025-06-05T17:42:34Z","snapshot_observed_at":"2026-08-10T16:56:54.588021Z","submitted_at":"2025-06-05T17:42:34Z","title":"Video World Models with Long-term Spatial Memory","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:39.512049Z"},"links":{"cited_paper":"/paper/2409.02097","citing_paper":"/paper/2506.05284"},"observation_digest":"sha256:fa46417b7bfb8e929fecc2af9e632745994f6530faf63885cda9d9a604367d00","observation_id":"d98c8544-43ef-4d71-ba2b-244e82ba604d","resolution":{"observed_at":"2026-08-07T10:28:39.512049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02097","last_updated":"2024-10-17T08:09:37Z","snapshot_observed_at":"2026-08-09T17:41:45.360146Z","submitted_at":"2024-09-03T17:54:39Z","title":"LinFusion: 1 GPU, 1 Minute, 16K Image","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02097","snapshot_observed_at":"2026-08-07T10:29:04.695484Z","title":"Linfusion: 1 gpu, 1 minute, 16k image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05340","last_updated":"2025-06-06T17:59:47Z","snapshot_observed_at":"2026-08-08T23:57:15.811108Z","submitted_at":"2025-06-05T17:59:40Z","title":"Exploring Diffusion Transformer Designs via Grafting","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T10:29:04.695484Z"},"links":{"cited_paper":"/paper/2409.02097","citing_paper":"/paper/2506.05340"},"observation_digest":"sha256:31c3b0b2ac19e4e1e7ad64ec96a55cc35c083954bf0e1cd267c1b27f4dee21ca","observation_id":"cd191463-0216-4f84-963f-05e85a2ca15b","resolution":{"observed_at":"2026-08-07T10:29:04.695484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02097","last_updated":"2024-10-17T08:09:37Z","snapshot_observed_at":"2026-08-09T17:41:45.360146Z","submitted_at":"2024-09-03T17:54:39Z","title":"LinFusion: 1 GPU, 1 Minute, 16K Image","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02097","snapshot_observed_at":"2026-08-05T22:21:05.627730Z","title":"Linfusion: 1 gpu, 1 minute, 16k image,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.627730Z"},"links":{"cited_paper":"/paper/2409.02097","citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:cab55c5c1fc920b6bc79d0a0dafe715451f9018bba1810792a0f1bffc28e22bf","observation_id":"19a70a53-fd62-493b-b926-1a63816c9bf1","resolution":{"observed_at":"2026-08-05T22:21:05.627730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02097","last_updated":"2024-10-17T08:09:37Z","snapshot_observed_at":"2026-08-09T17:41:45.360146Z","submitted_at":"2024-09-03T17:54:39Z","title":"LinFusion: 1 GPU, 1 Minute, 16K Image","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02097","snapshot_observed_at":"2026-08-04T09:20:06.875247Z","title":"Linfusion: 1 gpu, 1 minute, 16k image.arXiv preprint arXiv:2409.02097, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:06.875247Z"},"links":{"cited_paper":"/paper/2409.02097","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:42363a6bd1f6c7b19df9e0f94a488adf2d3952fbf666987c64f455a5a7870aba","observation_id":"6bbafdf3-6dff-4da1-ac68-89a60b371c21","resolution":{"observed_at":"2026-08-04T09:20:06.875247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02097","last_updated":"2024-10-17T08:09:37Z","snapshot_observed_at":"2026-08-09T17:41:45.360146Z","submitted_at":"2024-09-03T17:54:39Z","title":"LinFusion: 1 GPU, 1 Minute, 16K Image","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02097","snapshot_observed_at":"2026-08-03T10:56:13.971631Z","title":"Linfusion: 1 gpu, 1 minute, 16k image.arXiv preprint arXiv:2409.02097, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.08303","last_updated":"2026-07-06T07:20:34Z","snapshot_observed_at":"2026-08-07T13:59:11.336528Z","submitted_at":"2026-01-13T07:46:46Z","title":"SnapGen++: Unleashing Diffusion Transformers for Efficient High-Fidelity Image Generation on Edge Devices","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T10:56:13.971631Z"},"links":{"cited_paper":"/paper/2409.02097","citing_paper":"/paper/2601.08303"},"observation_digest":"sha256:aac4589c3e2bca9262abac007eef357743e6768f771528cb6474aab78f30ba02","observation_id":"3924b6fe-0d69-44da-9a0e-4d67809dc8fa","resolution":{"observed_at":"2026-08-03T10:56:13.971631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02097","last_updated":"2024-10-17T08:09:37Z","snapshot_observed_at":"2026-08-09T17:41:45.360146Z","submitted_at":"2024-09-03T17:54:39Z","title":"LinFusion: 1 GPU, 1 Minute, 16K Image","version":3},"cited_work":{"arxiv_id":"2409.02097","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.02097","snapshot_observed_at":"2026-06-29T18:13:48.401465Z","title":"Linfusion: 1 gpu, 1 minute, 16k image","venue":null,"work_id":"cc204525-6d29-4d49-b8b1-6e732eff9d40","year":2024},"citing_paper":{"arxiv_id":"2605.17294","last_updated":"2026-05-17T07:14:15Z","snapshot_observed_at":"2026-08-01T15:25:45.426529Z","submitted_at":"2026-05-17T07:14:15Z","title":"HierEdit: Region-Aware Hierarchical Diffusion for Efficient High-Resolution Editing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T14:40:20.517450Z"},"links":{"cited_paper":"/paper/2409.02097","citing_paper":"/paper/2605.17294"},"observation_digest":"sha256:7943abcc90eb4317ea99ce39556afa66e21b5b794b54196611d8ab65a77b573d","observation_id":"4147bfd2-a1d1-43ee-a93c-b309a0d6b2b8","resolution":{"observed_at":"2026-05-20T14:43:22.561733Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02097","last_updated":"2024-10-17T08:09:37Z","snapshot_observed_at":"2026-08-09T17:41:45.360146Z","submitted_at":"2024-09-03T17:54:39Z","title":"LinFusion: 1 GPU, 1 Minute, 16K Image","version":3},"cited_work":{"arxiv_id":"2409.02097","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.02097","snapshot_observed_at":"2026-06-29T18:13:48.401465Z","title":"Linfusion: 1 gpu, 1 minute, 16k image","venue":null,"work_id":"cc204525-6d29-4d49-b8b1-6e732eff9d40","year":2024},"citing_paper":{"arxiv_id":"2605.20147","last_updated":"2026-05-19T17:35:09Z","snapshot_observed_at":"2026-07-06T23:30:44.092395Z","submitted_at":"2026-05-19T17:35:09Z","title":"PixVerve: Advancing Native UHR Image Generation to 100MP with a Large-Scale High-Quality Dataset","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-20T05:19:30.372528Z"},"links":{"cited_paper":"/paper/2409.02097","citing_paper":"/paper/2605.20147"},"observation_digest":"sha256:299a1e41c21170cef0f702f3a83117d8a0e0a04bb2bb81f130847950a5097ef1","observation_id":"15d1ca9e-256c-4ec1-9c1d-c0a458e771e5","resolution":{"observed_at":"2026-05-20T05:23:03.904990Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02097","last_updated":"2024-10-17T08:09:37Z","snapshot_observed_at":"2026-08-09T17:41:45.360146Z","submitted_at":"2024-09-03T17:54:39Z","title":"LinFusion: 1 GPU, 1 Minute, 16K Image","version":3},"cited_work":{"arxiv_id":"2409.02097","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.02097","snapshot_observed_at":"2026-06-29T18:13:48.401465Z","title":"Linfusion: 1 gpu, 1 minute, 16k image","venue":null,"work_id":"cc204525-6d29-4d49-b8b1-6e732eff9d40","year":2024},"citing_paper":{"arxiv_id":"2605.26636","last_updated":"2026-05-26T07:17:27Z","snapshot_observed_at":"2026-08-05T14:13:53.444731Z","submitted_at":"2026-05-26T07:17:27Z","title":"JetViT: Efficient High-Resolution Vision Transformer with Post-Training Attention Search","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T18:12:21.124678Z"},"links":{"cited_paper":"/paper/2409.02097","citing_paper":"/paper/2605.26636"},"observation_digest":"sha256:2a066951894a0b112c62ba321cb50f8eb21c5b1dd3cba8b2652609a3c61dd132","observation_id":"626281fc-71c4-4dd3-8924-4904de66788d","resolution":{"observed_at":"2026-06-29T18:13:48.402865Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02097","last_updated":"2024-10-17T08:09:37Z","snapshot_observed_at":"2026-08-09T17:41:45.360146Z","submitted_at":"2024-09-03T17:54:39Z","title":"LinFusion: 1 GPU, 1 Minute, 16K Image","version":3},"cited_work":{"arxiv_id":"2409.02097","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.02097","snapshot_observed_at":"2026-06-29T18:13:48.401465Z","title":"Linfusion: 1 gpu, 1 minute, 16k image","venue":null,"work_id":"cc204525-6d29-4d49-b8b1-6e732eff9d40","year":2024},"citing_paper":{"arxiv_id":"2606.00746","last_updated":"2026-05-30T14:29:43Z","snapshot_observed_at":"2026-07-06T23:41:24.911421Z","submitted_at":"2026-05-30T14:29:43Z","title":"Scaling Parallel Sequence Models to Foundation-Scale Vision Encoders","version":1},"reference_index":123,"source":"arxiv_source","source_observed_at":"2026-06-28T19:23:08.100056Z"},"links":{"cited_paper":"/paper/2409.02097","citing_paper":"/paper/2606.00746"},"observation_digest":"sha256:508f896fff32410446a8b9b8ec57dbce3e96609268cb336cc2ece1b874c6b674","observation_id":"38cd8e5f-3b5d-40f3-8dd3-02c8dd248124","resolution":{"observed_at":"2026-06-28T19:32:35.228393Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2409.02097/citation-record","integrity":"/paper/2409.02097/integrity","json":"/paper/2409.02097/citation-record.json","paper":"/paper/2409.02097"},"outbound":[],"paper":{"arxiv_id":"2409.02097","last_updated":"2024-10-17T08:09:37Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T17:41:45.360146Z","submitted_at":"2024-09-03T17:54:39Z","title":"LinFusion: 1 GPU, 1 Minute, 16K Image"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2409.02097."}