{"as_of":"2026-08-21T10:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3851115213516e5272f0b09128d3d93f5b132bba1dc4dd0fd9a1a635dfe1c5c2","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T05:26:29.331382Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T17:35:39.863457Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.20808","snapshot_observed_at":"2026-08-01T17:35:39.863457Z","title":"Spatial gram align- ment for ultra-high-resolution image synthesis,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17585","last_updated":"2026-08-12T11:53:54Z","snapshot_observed_at":"2026-08-20T08:17:39.303195Z","submitted_at":"2026-07-20T06:04:08Z","title":"Pixel-Space Diffusion Transformers","version":2},"reference_index":115,"source":"pdf_text","source_observed_at":"2026-08-01T17:35:39.863457Z"},"links":{"cited_paper":"/paper/2605.20808","citing_paper":"/paper/2607.17585"},"observation_digest":"sha256:df774818aa7dd330de97396e89816c336f60616260d68ff5ca59375b8f9f6455","observation_id":"b5596d73-1ebd-4d37-8001-be108b7dac3e","resolution":{"observed_at":"2026-08-01T17:35:39.863457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.20808/citation-record","integrity":"/paper/2605.20808/integrity","json":"/paper/2605.20808/citation-record.json","paper":"/paper/2605.20808"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Photorealistic text-to- image diffusion models with deep language understanding","venue":null,"work_id":"a0ddbb25-7715-4a10-83d4-49f6a0644575","year":2022},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:843f05d4e2a2f22cc5aa541f48667919ff5a588c9829cf205e055a55dfda2bc3","observation_id":"5a895a95-5c54-451c-b8b1-00bd1ed0018e","resolution":{"observed_at":"2026-05-21T05:34:41.081170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2408.07009","doi":"10.48550/arxiv.2408.07009","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagen 3","venue":"arXiv (Cornell University)","work_id":"a1dd317f-8300-4a79-a1d0-92ddd93fa983","year":2024},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:3d10621ea1a5ee5bc1c49f77c807b2c440b701bc47056bcce5dce06d39840fea","observation_id":"13bb182f-880f-4a2a-ad78-30fd2990fa7e","resolution":{"observed_at":"2026-05-21T05:29:39.671187Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:30.169107+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:30.169107+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":"2204.06125","doi":"10.48550/arxiv.2204.06125","metadata_source":"pith","pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","venue":"cs.CV","work_id":"0c6a768b-70b8-4242-bb0e-459f1008c9fc","year":2022},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:19a3a2518269d54cda9c1f9be7c6c4e21fb744617dac94182d0ec8a53848cbaa","observation_id":"3c7ef8f8-7d29-427a-a673-cbd24d63dad1","resolution":{"observed_at":"2026-05-21T05:29:39.680258Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-13T20:38:17.101149+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T20:38:17.101149+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving image generation with better captions.Computer Science","venue":null,"work_id":"fb7509a6-ece6-4ea3-b583-1ec884016dc8","year":2023},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:9dd5daf6ee43025f524aada8bbbf65ffa234cf4dfe9642c196c8c268ca3fdb95","observation_id":"071900ae-e5b2-4a5a-a4fb-61f42f800fcc","resolution":{"observed_at":"2026-05-21T05:34:41.079237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:05:18.649491Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"3cba96fb-e636-4639-8d43-2f25ce21d4d1","year":2022},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:fdfbc099d9edb494c6c17bc376c29210f909650f6fbd64f4ad6decd2e3e330dc","observation_id":"46378ae8-087e-4f4a-b079-627bd6d96a13","resolution":{"observed_at":"2026-05-21T09:24:06.370034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T00:05:48.537771Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":"8331d9c0-b11b-4b03-89a7-e461fa541183","year":2024},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:d9b11c52a54e7abe5463b4d4650b16f1544c7842bbf5656be95370f85d7406a4","observation_id":"dbfe16f1-a335-4ff0-9ddf-7a042ec862a3","resolution":{"observed_at":"2026-05-21T05:34:41.076975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:24:32.608532Z","title":"Flux","venue":null,"work_id":"eb5a48ab-3a42-448c-8ed6-d045bb6c8754","year":2024},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:f4967e4dfdde61e926e22044e87efeb353e82495a96b99c11191c2e05c6e287b","observation_id":"5f9d528c-ff8f-4df4-a47f-8c49d239a6a8","resolution":{"observed_at":"2026-05-21T09:19:57.798788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:27:52.995100Z","title":"Emerging properties in self-supervised vision transformers","venue":null,"work_id":"def40bfd-07b5-4f25-94fd-883b4ac6838d","year":2021},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:6fd88614192ab176be8d95d863b2a6edea5788f2060f35cd87ea565dd1debb91","observation_id":"6716fd7b-9775-4178-8a87-b568fea3e8a6","resolution":{"observed_at":"2026-05-21T09:24:06.371894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-17T13:03:40.359628Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":"2304.07193","doi":"10.48550/arxiv.2304.07193","metadata_source":"pith","pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DINOv2: Learning Robust Visual Features without Supervision","venue":"cs.CV","work_id":"26b304e5-b54a-4f26-be7e-83299eca52e4","year":2023},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:41b7e8fafbc703479da2c7850897b8657f76d2f1737ec6eb4a547564afffdf52","observation_id":"df81a482-3590-4e81-892c-a86348cf43e7","resolution":{"observed_at":"2026-05-21T05:29:39.677403Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-08-18T01:07:23.737664Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":"2508.10104","doi":"10.1055/a-2487-1252","metadata_source":"pith","pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DINOv3","venue":"cs.CV","work_id":"c8b07deb-8fe7-4e18-9620-f3569d3529ce","year":2025},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:105f35fe6b1d3ee7bc7477b3528f309756feb6a071aad9f061434bdc80857174","observation_id":"f536d63c-ba92-409b-bb97-2481964d09ef","resolution":{"observed_at":"2026-05-21T05:29:39.674436Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T17:52:45.338243Z","title":"Segment anything","venue":null,"work_id":"a94cd19f-c16e-4968-8847-f62cec39b43f","year":2023},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:fc667018f5ccdc7c4a79ae6576049ad65e22681e6c0565281353f0188e693d13","observation_id":"e1644fef-55cc-4bc5-9499-052b925f2eb3","resolution":{"observed_at":"2026-05-21T09:19:57.808975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":"2408.00714","doi":"10.1038/s41598-025-97590-3","metadata_source":"pith","pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 2: Segment Anything in Images and Videos","venue":"cs.CV","work_id":"acc13f66-d814-44f9-9688-375688bf2d4a","year":2024},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:49977a00ec3358ab2c288ba091e5ac9f56611c023c63fd87b169c22e01fbb542","observation_id":"a49d75d9-2567-44d4-8ed7-6b4a993b1488","resolution":{"observed_at":"2026-05-21T05:29:39.650229Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-05-24T04:24:23.885301+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T04:24:23.885301+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16719","last_updated":"2026-03-28T16:54:56Z","snapshot_observed_at":"2026-08-07T05:59:39.049027Z","submitted_at":"2025-11-20T18:59:56Z","title":"SAM 3: Segment Anything with Concepts","version":2},"cited_work":{"arxiv_id":"2511.16719","doi":"10.48550/arxiv.2511.16719","metadata_source":"pith","pith_arxiv_id":"2511.16719","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3: Segment Anything with Concepts","venue":"cs.CV","work_id":"4a72a006-2592-4554-aad0-a9c41a9f952d","year":2025},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"cited_paper":"/paper/2511.16719","citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:998adee684bb2773123712b2768667e86ccf3dcc792290c51e85fafe7ce09485","observation_id":"c2ff7eb5-cab3-4389-9178-5a150e0043f6","resolution":{"observed_at":"2026-05-21T05:29:39.683233Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:24.687473+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:24.687473+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06940","last_updated":"2025-06-18T04:35:42Z","snapshot_observed_at":"2026-07-06T19:30:26.233621Z","submitted_at":"2024-10-09T14:34:53Z","title":"Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think","version":4},"cited_work":{"arxiv_id":"2410.06940","doi":"10.48550/arxiv.2410.06940","metadata_source":"pith","pith_arxiv_id":"2410.06940","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think","venue":"cs.CV","work_id":"1aff8ef8-079b-4afe-9e6a-148e6fd08e6a","year":2024},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"cited_paper":"/paper/2410.06940","citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:248c2ad105500564d2fbd8a1bcf8c076823f7a5db0389e16dfde019f70978c47","observation_id":"58dad915-7c2a-48cb-bfe6-d9a3fac471db","resolution":{"observed_at":"2026-05-21T05:29:39.657389Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.10794","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T16:59:58.043629Z","title":"What matters for representation alignment: Global information or spatial structure?","venue":null,"work_id":"f1f54511-fa19-44c2-9a85-6b1016b6d627","year":2025},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:f525fce2ed5e78dd49747789c3ed36eb2aaf0224bb25bf2180991839efcb18fd","observation_id":"5aed0e8d-b4ae-4a28-9b48-00cffa04933b","resolution":{"observed_at":"2026-05-21T05:29:39.668154Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"REPA-E: Unlocking vae for end-to-end tuning of latent diffusion transformers","venue":null,"work_id":"81e6c65a-d1ce-4312-84cc-1a0a914d9770","year":2025},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:d10a72016220745fcd3ef016a0279a4f0955ff8fb541f3d4b45a635574388e81","observation_id":"4a2c2c6b-f00b-43ef-92a3-eac2ac3735fe","resolution":{"observed_at":"2026-05-21T09:24:06.367092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reconstruction vs","venue":null,"work_id":"6604c0f9-b567-4c87-9932-4018922f3475","year":2025},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:4bb36e486dad2583c8e6b797bb5fbe9cd6eca42cc50ef4fc8a55b9af89834de9","observation_id":"72edf86a-f41a-47bd-940e-6b00d09181f9","resolution":{"observed_at":"2026-05-21T09:19:57.796166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.11690","last_updated":"2025-10-13T17:51:39Z","snapshot_observed_at":"2026-08-13T23:51:28.874833Z","submitted_at":"2025-10-13T17:51:39Z","title":"Diffusion Transformers with Representation Autoencoders","version":1},"cited_work":{"arxiv_id":"2510.11690","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.11690","snapshot_observed_at":"2026-07-10T18:47:31.703880Z","title":"Diffusion Transformers with Representation Autoencoders","venue":"cs.CV","work_id":"c1a2d4de-4439-4005-8c56-e0124e4ed5fa","year":2025},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"cited_paper":"/paper/2510.11690","citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:24cf44be18af9837aced8ec97ae13e5bb833e283c65cba9969ee71ff49e81134","observation_id":"17578e02-2694-4034-baa4-30a847800191","resolution":{"observed_at":"2026-05-21T05:29:39.664821Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.17909","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T16:59:58.094526Z","title":"Both semantics and reconstruction matter: Making representation encoders ready for text-to-image generation and editing","venue":null,"work_id":"ac249882-c11f-4eb8-bee8-40dbdb267a6b","year":2025},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:4b0e93759581e5759a528e94a0a66c1e7b676e59b0adef6ed7f32365bc650a7e","observation_id":"d5b3aa8f-d927-4930-be4a-2dfbfd9f035d","resolution":{"observed_at":"2026-05-21T05:29:39.661725Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"355d6adc-3d6a-4ba1-8cc9-a27fb358c957","year":2009},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:c6f1c4362acb849d8614ce5d8fc841a4e53c7777a2e1d7dea02f0c980f81cdf4","observation_id":"96d4b8a1-a971-4de9-9983-54fcda557aaf","resolution":{"observed_at":"2026-05-21T05:34:41.108927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":"1312.6114","doi":"10.2139/ssrn.4269703","metadata_source":"pith","pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Auto-Encoding Variational Bayes","venue":"stat.ML","work_id":"97d95295-30e1-42b4-bbf6-85f0fa4edb44","year":2013},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:0f33311c2956cc4378a00b26f40684e8a7996ed0fe9f39a4cfb5aeff30ebe3ae","observation_id":"44801168-8ded-413e-829f-4a1c22fcb6f2","resolution":{"observed_at":"2026-05-21T05:29:39.654138Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T11:37:03.961552Z","title":"Neural discrete representation learning.Advances in neural information processing systems, 30","venue":null,"work_id":"fc5f624c-48dd-4025-98ca-bbad7482fd3d","year":2017},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:ef1968ed39de248177da5c49a2742cc06013eef6371ca487ea680117b76d6877","observation_id":"48c4b960-d55c-4ef5-9e0f-74179cae115e","resolution":{"observed_at":"2026-05-21T05:34:41.111325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T06:36:03.280140Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":"efdd8568-38ef-4a4f-85e1-0b5c2b288584","year":2021},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:40ee55fd6299a28ebfbd6297f8f08bd24abb22f2c0ab9a09664e6e0c37789f9d","observation_id":"f4affd75-3293-48f1-a211-4a07b95cb626","resolution":{"observed_at":"2026-05-21T09:19:57.804088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GANs trained by a two time-scale update rule converge to a local nash equilibrium.Advances in neural information processing systems, 30","venue":null,"work_id":"059b2b2e-72b5-4cba-aaef-23aa59ca1690","year":2017},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:c9dcb948a980dfe50ffc6c6a1e27be20e59bd568fe31b07834f17b60c222c958","observation_id":"40a0794e-8f3b-4b4b-bc8c-e951ac2c56df","resolution":{"observed_at":"2026-05-21T09:19:57.801469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"UltraPixel: Advancing ultra high-resolution image synthesis to new peaks.Advances in Neural Information Processing Systems, 37:111131–111171","venue":null,"work_id":"5ad03da3-c53f-4b3f-94e9-4717efe09e93","year":2024},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:f53f4b7f6bee42f919ae4de41ffee29a38e0610a4b5b0db0c4a357500cccdc31","observation_id":"d4d4728d-1781-458d-81bb-219e66cba343","resolution":{"observed_at":"2026-05-21T09:19:57.806626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.20661","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ultrahr-100k: En- hancing uhr image synthesis with a large-scale high-quality dataset","venue":null,"work_id":"d931ec71-5f37-4f56-91e8-d7abca38441a","year":2025},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:155a1aa8cf0d463487a79d6d179055609fdd92786b91d0f78db56651f701d910","observation_id":"e2d99e17-6c5d-4c86-8d58-3d8ff887784a","resolution":{"observed_at":"2026-05-21T05:29:39.622843Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10629","last_updated":"2024-10-20T14:35:31Z","snapshot_observed_at":"2026-08-20T10:31:24.549119Z","submitted_at":"2024-10-14T15:36:42Z","title":"SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers","version":3},"cited_work":{"arxiv_id":"2410.10629","doi":"10.48550/arxiv.2410.10629","metadata_source":"pith","pith_arxiv_id":"2410.10629","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers","venue":"cs.CV","work_id":"c53bf282-3c74-4c37-a7bd-6531aee212b8","year":2024},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"cited_paper":"/paper/2410.10629","citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:f9d179c97a0f3ac086bd641d175e23846a56875f210ac20e5cab5252fae57aed","observation_id":"dd835528-53a0-433e-82ea-dc20cb89ec7f","resolution":{"observed_at":"2026-05-21T05:29:39.626006Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10733","last_updated":"2025-05-18T21:17:22Z","snapshot_observed_at":"2026-08-18T11:02:33.658704Z","submitted_at":"2024-10-14T17:15:07Z","title":"Deep Compression Autoencoder for Efficient High-Resolution Diffusion Models","version":8},"cited_work":{"arxiv_id":"2410.10733","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.10733","snapshot_observed_at":"2026-07-09T07:06:02.921871Z","title":"Deep compression autoencoder for efficient high-resolution diffusion models","venue":"cs.CV","work_id":"fb6e768c-674c-4587-921d-4c0ad09a87fd","year":2024},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"cited_paper":"/paper/2410.10733","citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:0f05170b645f5ed20168f246daa6b0c9316d1673679fed34e75aeb8bb5d4f333","observation_id":"ff0480dd-a694-4ded-aaf4-44634a3c443a","resolution":{"observed_at":"2026-05-21T05:29:39.614064Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion-4K: Ultra-high-resolution im- age synthesis with latent diffusion models","venue":null,"work_id":"0e5384c0-0c5f-4bf9-845e-2821e621d799","year":2025},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:064b37edef2b97413dc0ad18206fe32813193b9da8238668bdc232d361ad5bfa","observation_id":"0601b6e0-2948-4058-957d-e2b9bda56ca4","resolution":{"observed_at":"2026-05-21T05:34:41.101783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.04504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T21:05:04.424588Z","title":"Ultraimage: Rethinking resolution extrapolation in image diffusion transformers","venue":null,"work_id":"96de8753-8cba-49f5-8d17-51a9618ba6a8","year":2025},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:ba9354c7bc6c5aa3d158ae5ab598880c430ddc79dd6a68164edb6a5690138c9b","observation_id":"1d4e8d2d-93ab-4244-adeb-1d2c89f0dd87","resolution":{"observed_at":"2026-05-21T05:29:39.635046Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:27:53.186413Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"0c67bec8-6388-449f-9600-64c8ea9bc79f","year":2023},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:d0a909812c658a8c410f185927974918a652e0508389747087d9ba5d083dd189","observation_id":"8b48c6b6-9c1f-420a-9714-2eb09ac5a9e4","resolution":{"observed_at":"2026-05-21T05:34:41.103951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:46:41.692083Z","title":"Sit: Exploring flow and diffusion-based generative models with scalable interpolant transformers","venue":null,"work_id":"a08d2a16-a0ba-4b60-afd1-b5ffb9f4de4f","year":2024},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:5f6b3c40348639e989bc1457eac726209e905e2915c9f18a047f5ab99ca94fc9","observation_id":"222e10a4-b321-4d97-b1d0-90381d598548","resolution":{"observed_at":"2026-05-21T05:34:41.099784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.13720","last_updated":"2026-01-07T05:36:57Z","snapshot_observed_at":"2026-08-21T07:43:41.799880Z","submitted_at":"2025-11-17T18:59:57Z","title":"Back to Basics: Let Denoising Generative Models Denoise","version":2},"cited_work":{"arxiv_id":"2511.13720","doi":"10.48550/arxiv.2511.13720","metadata_source":"pith","pith_arxiv_id":"2511.13720","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Back to Basics: Let Denoising Generative Models Denoise","venue":"cs.CV","work_id":"37973de8-a5e6-4d92-897b-a98fa9f7f2f3","year":2025},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"cited_paper":"/paper/2511.13720","citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:b08c073cdc42acb64126da44dfdbf7d7d6e64b2ec951bd5a5592bed2364a01b6","observation_id":"8e9261cf-9d9c-45b2-a700-ceb80a4f42e0","resolution":{"observed_at":"2026-05-21T05:29:39.628883Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:11.792909+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:11.792909+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.16208","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T15:43:53.808402Z","title":"Scaling text-to-image diffusion transformers with representation autoencoders","venue":null,"work_id":"f6b79552-4f2d-4b7a-9874-6ef1938b8a54","year":2026},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:9ab430d17bf4734483ceb7974cb11e1c4fecbd51be041d65329cd51f14fe2681","observation_id":"2f71d84d-8e52-4ac6-a527-628390e1d5c6","resolution":{"observed_at":"2026-05-21T05:29:39.631940Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T14:37:16.225324Z","title":"Denoising diffusion probabilistic models.Advances in neural information processing systems, 33:6840–6851","venue":null,"work_id":"82ba805b-3e59-43c6-b37f-3aa1940eea68","year":2020},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:8ec524ae46fd1111ac6fc1139766689e8b8f1ee53aa39ddc1a3e53000527ad0d","observation_id":"781dde1c-e01a-43c4-b73e-8664dc9005fe","resolution":{"observed_at":"2026-05-21T09:19:57.790947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improved denoising diffusion probabilistic models","venue":null,"work_id":"6cab9edd-941f-456e-a2c6-0bc4e68729a3","year":2021},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:991e699e57330d9594cf354a2366a04e606eb988a1a6f4e3b9a3a450a0731bda","observation_id":"3359c121-ccba-4154-876f-a6d5dfb91979","resolution":{"observed_at":"2026-05-21T05:34:41.095254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-16T02:30:42.660030Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":"2210.02747","doi":"10.1038/s41467-024-47656-z","metadata_source":"pith","pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flow Matching for Generative Modeling","venue":"cs.LG","work_id":"6edb71c4-5d64-40af-a394-9757ea051a36","year":2022},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:a47c75d566f91f5703841e42a3f4afbce3fc85defb9e94bd53f1f9d48c6342d7","observation_id":"d522f5dc-5bca-4d10-8235-1cb9d26d9af6","resolution":{"observed_at":"2026-05-21T05:29:39.619899Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15571","last_updated":"2023-03-09T15:18:40Z","snapshot_observed_at":"2026-08-14T22:23:53.150627Z","submitted_at":"2022-09-30T16:30:31Z","title":"Building Normalizing Flows with Stochastic Interpolants","version":3},"cited_work":{"arxiv_id":"2209.15571","doi":"10.1093/mnras/staf336","metadata_source":"pith","pith_arxiv_id":"2209.15571","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Building Normalizing Flows with Stochastic Interpolants","venue":"cs.LG","work_id":"83654cbd-832b-4269-bec9-26faa87ececd","year":2022},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"cited_paper":"/paper/2209.15571","citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:14947c7f03c394d7a5b15bad301828fa590c52fe680562c7049ebef62870e7a7","observation_id":"cd3cfdcd-f3e0-4e17-bce2-a0c4f1e86f15","resolution":{"observed_at":"2026-05-21T05:29:39.617136Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-11T20:49:09.239152+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T20:49:09.239152+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03003","last_updated":"2022-09-07T08:59:55Z","snapshot_observed_at":"2026-07-06T13:49:40.974495Z","submitted_at":"2022-09-07T08:59:55Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","version":1},"cited_work":{"arxiv_id":"2209.03003","doi":"10.48550/arxiv.2209.03003","metadata_source":"pith","pith_arxiv_id":"2209.03003","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","venue":"cs.LG","work_id":"a1989e1b-d66d-4533-be3a-fb9c5fd62290","year":2022},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"cited_paper":"/paper/2209.03003","citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:81225d6f8404630a237d6d52d675691ce290dd7e15d848800b5c129e7ac12efb","observation_id":"14c434fd-fee4-455e-bc35-fd164351e01a","resolution":{"observed_at":"2026-05-21T05:29:39.639410Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-11T22:49:29.244251+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T22:49:29.244251+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23656","last_updated":"2025-05-29T17:06:44Z","snapshot_observed_at":"2026-08-15T14:35:51.945342Z","submitted_at":"2025-05-29T17:06:44Z","title":"VideoREPA: Learning Physics for Video Generation through Relational Alignment with Foundation Models","version":1},"cited_work":{"arxiv_id":"2505.23656","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23656","snapshot_observed_at":"2026-07-04T16:59:58.033217Z","title":"arXiv preprint arXiv:2505.23656 (2025)","venue":null,"work_id":"d810b0fc-7ae5-44e9-bd6e-bf39477b57a2","year":2025},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"cited_paper":"/paper/2505.23656","citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:03cd2cb7d8aacc66c344834f33476e212f6932a98b45190680398aa00dfc98db","observation_id":"e4378f01-936c-4241-8c9f-b3310203a143","resolution":{"observed_at":"2026-05-21T05:29:39.647375Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T17:57:26.568638Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":"ffd7b63b-f3e1-48da-bdd1-24909a005ca5","year":2018},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:1e8a7e06053dc1de5fc270599084d8874c8334f9322b96ca5ceb32cb9f99ec3a","observation_id":"ef497554-483e-40ef-b62c-ddf4a42d5d34","resolution":{"observed_at":"2026-05-21T05:34:41.097488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T19:44:04.936110Z","title":"Image-to-image translation with conditional adversarial networks","venue":null,"work_id":"6c2969ce-c757-42d4-b16e-f5996f5e0623","year":2017},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:a17f7d01d8c4a23119c23dfdd4a45d52a87ebef8a5e29db42ed8218f8ce16ef6","observation_id":"8c325919-da2e-496e-a431-aa023fb6e569","resolution":{"observed_at":"2026-05-21T05:34:41.106075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T06:36:03.249957Z","title":"A style-based generator architecture for generative adversarial networks","venue":null,"work_id":"47676735-d1ff-4462-aa72-d80a5748d6c8","year":2019},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:0207c64a02f280a024dbe01175acf72a0ff9d1691c89815ad2649f780fba829e","observation_id":"347f1b71-ada2-4e1f-8a2f-65b2252c052c","resolution":{"observed_at":"2026-05-21T05:34:41.113460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The Mapillary Vistas dataset for semantic understanding of street scenes","venue":null,"work_id":"3a9bd4c0-a6b5-4034-b597-ca90c4d5fd20","year":2017},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:957887d229acd496ac9537b4656396e4f7b88c70034f5d72eef33ce0cdd5b172","observation_id":"0340c18a-d783-45f7-81ed-1ac3a9739db0","resolution":{"observed_at":"2026-05-21T05:34:41.089528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:9ed95163a3af17efbb561d88df8e74ad19a6a8c405aa20ffd4ecaf2db1f37bee","observation_id":"07ae03a2-d56b-4ff6-947f-bba81eb2dc3c","resolution":{"observed_at":"2026-05-21T05:29:39.643306Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ZeRO: Memory optimizations toward training trillion parameter models","venue":null,"work_id":"283901da-e93f-4285-ac3a-909b585c5fbf","year":2020},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:9800f7a4173a595f20b764e88815a581a245009e5823aa516529eb21fb54fba3","observation_id":"105d97aa-069a-46d1-8d85-ef5ad0b39beb","resolution":{"observed_at":"2026-05-21T05:34:41.091525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ClipScore: A reference-free evaluation metric for image captioning","venue":null,"work_id":"4d6581cc-0e4e-46b2-bd7b-c5d417b56689","year":2021},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:3eba9f54d946d71dac51e1ee9313111ece1321c3335884c37faa2e4746349b8c","observation_id":"97f69731-015d-48db-bb24-9b346aeb2155","resolution":{"observed_at":"2026-05-21T05:34:41.085503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LAION-5B: An open large-scale dataset for training next generation image-text models.Advances in neural information processing systems, 35:25278–25294","venue":null,"work_id":"4970d371-039b-4c44-b92b-f38147bbadb2","year":2022},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:a030e791217087f6b697e34c3b966c92b2fb17ec79a4df9ea20d6b61518f9a3d","observation_id":"58b5e016-9164-4805-9080-c552a9579762","resolution":{"observed_at":"2026-05-21T09:19:57.793809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T17:57:26.576391Z","title":"Image quality assessment: from error visibility to structural similarity.IEEE transactions on image processing, 13(4):600–612","venue":null,"work_id":"9cbaa8a9-c031-41b2-bf97-f8b7a2b7cfff","year":2004},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:704f0d06ffcda911db1d16a3b0504812d4a80ff0a23142e1aabe5c463376cb88","observation_id":"bd1afc18-ae2a-4dc0-954a-b7c2a737b49d","resolution":{"observed_at":"2026-05-21T05:34:41.083393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:24:01.731473Z","title":"FLUX.2: Analyzing and enhancing the latent space of FLUX – representation comparison","venue":null,"work_id":"a333a135-6514-44c1-8577-2ff1f7af57ea","year":2025},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:25210e2425199cba4f0c57d9d59cb562450c24c60e06c92283b66c0498665663","observation_id":"20071e2a-9976-41f3-ac0a-f9fb2751ff6f","resolution":{"observed_at":"2026-05-21T05:34:41.087565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A useful variant of the Davis–Kahan theorem for statisticians.Biometrika, 102(2):315–323","venue":null,"work_id":"672b5e6e-881a-440a-853e-7fdf3b3063f4","year":2015},"citing_paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-21T05:26:29.331382Z"},"links":{"citing_paper":"/paper/2605.20808"},"observation_digest":"sha256:9c43ef4728076ed35000a0462296bbcbbd0a939301fdb181cefdcf937f718e0a","observation_id":"be29820f-0cea-4caf-843d-639639205112","resolution":{"observed_at":"2026-05-21T05:34:41.093422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.20808","last_updated":"2026-05-20T06:59:12Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T09:52:37.734880Z","submitted_at":"2026-05-20T06:59:12Z","title":"Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":0,"verified_exact":19,"verified_fuzzy":29},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 1 inbound Pith citation observation for arXiv:2605.20808."}