{"as_of":"2026-08-08T06:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:508c92581a72681cf2b7fb894cb09a3f27b898a1c67af204732335511d146b35","coverage":[{"denominator":89,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":89,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:50:49.088441Z","state":"measured"},{"denominator":92,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":92,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T20:52:40.076981Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T07:13:06.691905Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01331","snapshot_observed_at":"2026-08-03T20:52:40.076981Z","title":"Ultra-high-resolution image synthesis: Data, method and evaluation.arXiv preprint arXiv:2506.01331, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.18050","last_updated":"2025-11-22T13:07:21Z","snapshot_observed_at":"2026-08-06T13:47:39.734426Z","submitted_at":"2025-11-22T13:07:21Z","title":"UltraFlux: Data-Model Co-Design for High-quality Native 4K Text-to-Image Generation across Diverse Aspect Ratios","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T20:52:40.076981Z"},"links":{"cited_paper":"/paper/2506.01331","citing_paper":"/paper/2511.18050"},"observation_digest":"sha256:9f963ce2a71f3aa013e7743e0255148545612bcae78d99077c51fcf5d1712669","observation_id":"c0a322e9-a7c5-473d-ad31-807467abfdd1","resolution":{"observed_at":"2026-08-03T20:52:40.076981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"cited_work":{"arxiv_id":"2506.01331","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01331","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion-4k: Ultra-high-resolution image synthesis with latent diffusion models","venue":null,"work_id":"6667b6d3-6671-41d0-a833-bb9820faa92e","year":2025},"citing_paper":{"arxiv_id":"2605.19289","last_updated":"2026-05-19T03:07:04Z","snapshot_observed_at":"2026-08-03T00:49:51.226814Z","submitted_at":"2026-05-19T03:07:04Z","title":"What Makes Synthetic Data Effective in Image Segmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T07:08:16.047730Z"},"links":{"cited_paper":"/paper/2506.01331","citing_paper":"/paper/2605.19289"},"observation_digest":"sha256:f736740548af67ba215012e6cbfe71cb8db9febf959f97a3165818ac7b17a192","observation_id":"a613576c-4631-40ed-8346-ca6183e7b83b","resolution":{"observed_at":"2026-05-20T07:13:06.693746Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"cited_work":{"arxiv_id":"2506.01331","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01331","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion-4k: Ultra-high-resolution image synthesis with latent diffusion models","venue":null,"work_id":"6667b6d3-6671-41d0-a833-bb9820faa92e","year":2025},"citing_paper":{"arxiv_id":"2605.20147","last_updated":"2026-05-19T17:35:09Z","snapshot_observed_at":"2026-07-06T23:30:44.092395Z","submitted_at":"2026-05-19T17:35:09Z","title":"PixVerve: Advancing Native UHR Image Generation to 100MP with a Large-Scale High-Quality Dataset","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-20T05:19:30.372528Z"},"links":{"cited_paper":"/paper/2506.01331","citing_paper":"/paper/2605.20147"},"observation_digest":"sha256:09d1818f38ddc7830b4a5f3fe1ab56816bc83ce7c27a34452392f371602de44d","observation_id":"e5c69d98-5c16-4d4e-b9a9-8df1bf9cde04","resolution":{"observed_at":"2026-05-20T05:23:03.869281Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.01331/citation-record","integrity":"/paper/2506.01331/integrity","json":"/paper/2506.01331/citation-record.json","paper":"/paper/2506.01331"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:40.257693Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:40.257693Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:ec6639b093c770085f92fcb409df18424be714f471575c589fb6fa553634583a","observation_id":"6b51dfb4-35ba-4798-b3f1-d2effcabb94a","resolution":{"observed_at":"2026-08-07T11:50:40.257693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:40.325351Z","title":"Denoising diffusion implicit models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:40.325351Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:a65430794a30925d5cfb410572802a19a9e45b904551e0cc45e067a133bd88d3","observation_id":"f57eeffa-e774-4e4f-a520-bcafb30ecb60","resolution":{"observed_at":"2026-08-07T11:50:40.325351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:40.433106Z","title":"Score-based generative modeling through stochas- tic differential equations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:40.433106Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:b1f1df1d99a087158eacf81b4e0c99d079ea42ae584c1abf676b9e6aaf3cb9a3","observation_id":"f5004a1b-c7d7-4748-b7a5-b21041aed2e3","resolution":{"observed_at":"2026-08-07T11:50:40.433106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:40.557085Z","title":"Improved denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:40.557085Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:9c862f022fd7d471162f04193ffad0d990ac8d0b44a2fd4ce1b7b6ed13149b9a","observation_id":"b414e285-ec3a-4c5e-86c5-e2a5a1a112d7","resolution":{"observed_at":"2026-08-07T11:50:40.557085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:40.667490Z","title":"Maximum like- lihood training of score-based diffusion models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:40.667490Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:b4822d946aa9a483f4d49bc0ae4d9397dec67123ca61ba9edfa3e1c48c82f77d","observation_id":"bb759c49-7b6c-4559-af4f-794edfa313bf","resolution":{"observed_at":"2026-08-07T11:50:40.667490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:40.828780Z","title":"Score-based generative mod- eling in latent space,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:40.828780Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:d96d7a1a596c4c54dd11c7f57f441d90f88b01694231038ba5e3eaf87db9bcfe","observation_id":"db66b78a-2abe-47eb-aa93-9a8975274066","resolution":{"observed_at":"2026-08-07T11:50:40.828780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:41.006194Z","title":"Diffusion models beat gans on image synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:41.006194Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:6315e8e49434becb4a11dd44b748317b96fab18c75cd5dfce0ebc643a427af21","observation_id":"9e2f6435-ce20-45d0-8203-e3edf1404fad","resolution":{"observed_at":"2026-08-07T11:50:41.006194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:41.144211Z","title":"Elucidating the design space of diffusion-based generative models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:41.144211Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:2928be54e3b0e97b6d53e16cda485ab1a906235369bb7b0cb85f699834ade6e3","observation_id":"f77e3263-d74e-47b6-ac37-ad65ed0c1e33","resolution":{"observed_at":"2026-08-07T11:50:41.144211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:41.293769Z","title":"GLIDE: Towards photorealistic image generation and editing with text-guided diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:41.293769Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:e4edc4594af78bb5158da27fbc5c64fbfd544dca3921419a666f3d88017b4b9e","observation_id":"3865c9b1-038c-40d9-bf7a-1366788b47a5","resolution":{"observed_at":"2026-08-07T11:50:41.293769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-07T11:50:41.442957Z","title":"Classifier-free diffusion guidance,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:41.442957Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:4dd1197231c9f6b57304602f573a3d6ccad9d6d0e0ad876d6d10d78310f92ad1","observation_id":"d42c223e-6a13-4ae3-9c77-dff7c417f965","resolution":{"observed_at":"2026-08-07T11:50:41.442957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:57.986758Z","title":"Multimodal image synthesis and edit- ing: The generative ai era,","venue":null,"work_id":"f624d64a-3d0e-400b-b949-d4c65fba78a5","year":2023},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:41.560469Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:11c9a9a2f25fc540876ddc66fa0c51c00aa51624b3bb37d4826ea275edfe0337","observation_id":"ca63cb4c-885d-4c69-ac40-9eb840e97311","resolution":{"observed_at":"2026-08-07T11:50:58.060472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:57.730084Z","title":"Diffusion models: A comprehensive survey of methods and applications,","venue":null,"work_id":"d7026361-1745-4086-bb2b-29bd3e307721","year":2023},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:41.661804Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:c9f53eeeb6e698e185a6fd03b27cdd7c4f93ac62f7b82df734a01918ffe25a52","observation_id":"ef765837-839f-48ce-ad20-062845a20c4b","resolution":{"observed_at":"2026-08-07T11:50:57.836681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:57.515303Z","title":"Scalable diffusion models with transform- ers,","venue":null,"work_id":"cce64b70-06d8-42d8-ba52-e11063b218b6","year":2023},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:41.769335Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:e0f3ba593898f86d1b6c5cf1341fd259b231b95fdc7ef87351dd46c3433bb2b4","observation_id":"d0778841-62fa-48ac-8d12-f89c13135441","resolution":{"observed_at":"2026-08-07T11:50:57.621010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:57.324317Z","title":"Diffusion models in vision: A survey,","venue":null,"work_id":"13a4e211-2377-4d96-8656-293ff197fe61","year":2023},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:41.903281Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:116c94ff25cf56b2b7888ac4a15e0f40ccc5246973ac7b521a93f811b5da3807","observation_id":"9aebffb9-c2af-4b65-95c0-eb884a54bd29","resolution":{"observed_at":"2026-08-07T11:50:57.414481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:57.026407Z","title":"A diffusion model translator for efficient image-to-image translation,","venue":null,"work_id":"89917a1f-08ef-43e0-af08-75b04934ef7e","year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:41.994150Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:077874bfe283122c63307c9e9e0bd62ee726bf4577cc77ab4ad6c053c1bebd28","observation_id":"f2878ff6-0482-4816-bfcf-cd41b59589a5","resolution":{"observed_at":"2026-08-07T11:50:57.186142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:56.811052Z","title":"Photorealistic text-to-image diffusion models with deep lan- guage understanding,","venue":null,"work_id":"2184e283-2040-4800-9d72-c5016e852efd","year":2022},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:42.135846Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:778b79185104dcabd501e97ecdd015185fa3b7419b5c23fc1e4a79115211a0c0","observation_id":"bc64f171-a26d-4b9e-8de4-01724722b49d","resolution":{"observed_at":"2026-08-07T11:50:56.920679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:42.244156Z","title":"Imagen 3,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:42.244156Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:c6a82446cc1c722ff12b5ed12cc9435dae7df8d32615558dcb16706ecaad05fc","observation_id":"75dbdbf6-d79f-48c6-aae1-2ef1b24dbe80","resolution":{"observed_at":"2026-08-07T11:50:42.244156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-07T11:50:42.360822Z","title":"Hier- archical text-conditional image generation with clip latents,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:42.360822Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:69a873643ddffd971368146eebf17f27114ce87072eae39535003427dd9c8ef2","observation_id":"5e0066fa-9beb-469a-bd02-88c932d87c17","resolution":{"observed_at":"2026-08-07T11:50:42.360822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:56.600771Z","title":"Improv- ing image generation with better captions,","venue":null,"work_id":"8e9a5622-cb94-42fc-8302-4f4bb95bac10","year":2023},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:42.452701Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:bdde0aa224569547e615fdb2227ff09786dcaaeb489d3302821b423bf0d4eca6","observation_id":"c4381657-8216-4b68-8dc6-561b1b6a4535","resolution":{"observed_at":"2026-08-07T11:50:56.700818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:56.352983Z","title":"High-resolution image synthesis with latent diffusion models,","venue":null,"work_id":"c5bacbb0-0641-4b8a-b06d-e27f0ce6588b","year":2022},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:42.536310Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:2394271879bbba734bef0521c47a24d20c75cc6cd7ecb066bf74d1193ca384d5","observation_id":"f8a50306-3222-4ab6-ab29-1643118c30c3","resolution":{"observed_at":"2026-08-07T11:50:56.466564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:56.095368Z","title":"SDXL: Improving latent diffusion models for high-resolution image synthesis,","venue":null,"work_id":"4bd882e8-d08c-4783-ac58-739a61fdb343","year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:42.632540Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:e885fa220036c46e88f85b55ba1f65551ca764d32aad522129835bd06d543495","observation_id":"f975b06b-408b-4570-9daa-01180da3db90","resolution":{"observed_at":"2026-08-07T11:50:56.219409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:55.951576Z","title":"Scaling rectified flow transformers for high-resolution image synthesis,","venue":null,"work_id":"86a3ab35-2492-4824-988c-e845b49ae84d","year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:42.714124Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:2ef4afbc8c66ca805fb629be7c185495fdd84b5fae82a0d93038d8f4e3b53b6d","observation_id":"88fd3aaa-8eba-4db6-95b4-fc7db47470c1","resolution":{"observed_at":"2026-08-07T11:50:56.017108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:55.814051Z","title":"PixArt-Σ: Weak-to-strong training of diffusion trans- former for 4k text-to-image generation,","venue":null,"work_id":"ac462fc4-8bb4-402a-a808-50ed1221600a","year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:42.779493Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:501c5cf79d6ca5b878d349a8821b90f343bbb3634941b63d95d43f79c5de7de4","observation_id":"b340314c-5bb5-40a7-bdc2-ca3fc57e726a","resolution":{"observed_at":"2026-08-07T11:50:55.851166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17245","last_updated":"2024-02-27T06:31:52Z","snapshot_observed_at":"2026-07-06T17:36:01.939242Z","submitted_at":"2024-02-27T06:31:52Z","title":"Playground v2.5: Three Insights towards Enhancing Aesthetic Quality in Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17245","snapshot_observed_at":"2026-08-07T11:50:42.848297Z","title":"Playground v2.5: Three insights towards enhancing aesthetic quality in text-to-image generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:42.848297Z"},"links":{"cited_paper":"/paper/2402.17245","citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:64d9cfbd1ac66e57c97e3b3b1371acf3dd4bae9b0141632e0e3770c16766ed8b","observation_id":"a0f61c82-e9ef-49db-897b-54e27e0e3f8e","resolution":{"observed_at":"2026-08-07T11:50:42.848297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10695","last_updated":"2024-10-21T20:01:13Z","snapshot_observed_at":"2026-07-06T19:16:23.103921Z","submitted_at":"2024-09-16T19:52:24Z","title":"Playground v3: Improving Text-to-Image Alignment with Deep-Fusion Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10695","snapshot_observed_at":"2026-08-07T11:50:42.929835Z","title":"Playground v3: Improving text-to- image alignment with deep-fusion large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:42.929835Z"},"links":{"cited_paper":"/paper/2409.10695","citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:f8cdf0cfdfdfb812777dbfed3ae4eacf74d90cdb62b7c0b3196b4b47f54fe8e1","observation_id":"b09a834a-4aeb-4896-b560-eb95b88b368c","resolution":{"observed_at":"2026-08-07T11:50:42.929835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:55.728011Z","title":"Diffusion-4k: Ultra-high-resolution image synthesis with latent diffusion mod- els,","venue":null,"work_id":"33aea065-2703-4aa9-8c44-3dbe1d46b089","year":2025},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:43.028898Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:3c5580f2c0125427dd64a12a80e88846ff210ac429a36a4acbc42edcba350534","observation_id":"e93d3e18-f841-434c-b733-1e0f2472a0a4","resolution":{"observed_at":"2026-08-07T11:50:55.775113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:55.662810Z","title":"(2024) Flux","venue":null,"work_id":"448ffb00-ef00-4bf9-aac8-c6e3aa3f0b8a","year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:43.139728Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:a1b9599a8eddfa15d6d314ca0f0a95b63953fdc49c8a1514aaeab1e13cdcc09f","observation_id":"80295a01-c294-4215-b304-97bf6cd32297","resolution":{"observed_at":"2026-08-07T11:50:55.686540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:55.611819Z","title":"Flow matching for generative modeling,","venue":null,"work_id":"60e152d0-e1ae-491e-a24c-9ea168c18264","year":2023},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:43.241335Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:40db27c4fe37898268a9b624066279f180860fc98d1f22c3c5b7c64a993af614","observation_id":"327f7907-15b0-4fb8-9b15-94b2bc5a20d4","resolution":{"observed_at":"2026-08-07T11:50:55.627444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:55.560321Z","title":"Flow straight and fast: Learning to generate and transfer data with rectified flow,","venue":null,"work_id":"27ed8e1f-24d4-46f4-a511-88e43d1b7c3a","year":2023},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:43.327005Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:2f7c997e49b8ad264d230cc1631c5bee634425cd1702c084865955eb8d663c88","observation_id":"bdfc2e5a-1d39-46f9-8570-7057d92dabaa","resolution":{"observed_at":"2026-08-07T11:50:55.590588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:55.481765Z","title":"Building normalizing flows with stochastic interpolants,","venue":null,"work_id":"5e5d8c47-e35e-40c3-9167-380b4f7440b8","year":2023},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:43.409059Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:cbbd5de3b689fbb20970af1d1b8f53b43a2a5c8f9cb25fc05734a7e8d21cff41","observation_id":"7f20592d-0bea-4f31-8460-2530d60e37ba","resolution":{"observed_at":"2026-08-07T11:50:55.519628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:55.393561Z","title":"Sit: Exploring flow and diffusion-based generative models with scalable interpolant transformers,","venue":null,"work_id":"8c4e0c22-32df-4f8f-a3a9-d7330e9e7dff","year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:43.505722Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:25a1f99d753a9facd18f37108191729cd467897357466a3fbe7c1d4a6fc12fdf","observation_id":"6cb34d7f-531c-495a-9e56-a94be90d82d6","resolution":{"observed_at":"2026-08-07T11:50:55.440968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:55.299946Z","title":"Sana: Efficient high-resolution image synthesis with lin- ear diffusion transformers,","venue":null,"work_id":"ef2c29de-58c8-437f-8ade-fe44d68ba6fb","year":2025},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:43.592287Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:51b5d6bea808dde08b47eec9edeb1fc6cc531ad1e93112d81c95c235ce5aaea8","observation_id":"7ef4ed1a-9fe8-4959-addd-c685cd009a58","resolution":{"observed_at":"2026-08-07T11:50:55.345210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18427","last_updated":"2025-05-17T13:26:31Z","snapshot_observed_at":"2026-08-06T13:34:35.279373Z","submitted_at":"2025-01-30T15:31:48Z","title":"SANA 1.5: Efficient Scaling of Training-Time and Inference-Time Compute in Linear Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18427","snapshot_observed_at":"2026-08-07T11:50:43.669776Z","title":"Sana 1.5: Efficient scaling of training-time and inference-time compute in linear diffusion transformer,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:43.669776Z"},"links":{"cited_paper":"/paper/2501.18427","citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:41e74fbe3ca3dcaaafbfd6828955f57807ef4bcd018112d097dfd6da8dbf1248","observation_id":"962eb343-9db2-4633-8945-cf765f1df0d9","resolution":{"observed_at":"2026-08-07T11:50:43.669776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T11:50:43.745208Z","title":"GPT-4o system card,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:43.745208Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:7e6e4dcbe712c229f8b0f045dc37d0638446ac78a492c3fbba80a2e1444427eb","observation_id":"451d75f8-963a-458a-b359-0be1c50a6262","resolution":{"observed_at":"2026-08-07T11:50:43.745208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:55.238660Z","title":"Gans trained by a two time-scale update rule converge 15 to a local nash equilibrium,","venue":null,"work_id":"de60df5e-b04a-4f42-a32d-5c3ff6afa902","year":2017},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:43.825842Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:03db933f9ba5ae2233a70d2b76b070624bba4d9988ca4612419eb6ecc5904437","observation_id":"3fcad428-a155-4f2b-9846-422d22e1d992","resolution":{"observed_at":"2026-08-07T11:50:55.263489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:55.175558Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models,","venue":null,"work_id":"ad854339-04f2-4e11-b4ef-068be2baa6bc","year":2022},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:43.906712Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:b54dd2bc7b589ba82beb287594c697b60e92d30e9fe22b2fa1b28f8489d4e915","observation_id":"a2f52b3b-f351-4cf5-8c41-1ffcc61a3206","resolution":{"observed_at":"2026-08-07T11:50:55.197568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:55.096791Z","title":"Clip- score: A reference-free evaluation metric for image captioning,","venue":null,"work_id":"704ecd69-e701-4bea-b621-9b4bc75fc5af","year":2021},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:43.988936Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:93d6be4820b92fc65025c20f6e50671d701ddf161f08c1bc26b983f5a1cc69fb","observation_id":"ef8c379d-8cc1-4e59-a9d4-845d41036ea1","resolution":{"observed_at":"2026-08-07T11:50:55.131672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:55.014764Z","title":"Segment anything,","venue":null,"work_id":"ef1aec2c-e6c8-4d56-853e-81036863fc1c","year":2023},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:44.100891Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:b8b24ded82e7fb9a6cf49a86ac16b3dea47c4afcc9018f982e0641bba4a75eb1","observation_id":"d01d8e6b-387a-48de-9e15-8c8e3791e0ad","resolution":{"observed_at":"2026-08-07T11:50:55.049824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:54.926987Z","title":"Taming transformers for high-resolution image synthesis,","venue":null,"work_id":"e53f7126-680f-4619-8901-80b439804c5a","year":2021},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:44.196793Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:366049218edb3e9c6614a44e42e05e5a188ebdc7265728b28eddcdeb88d13366","observation_id":"bc0402d9-3618-4d73-9c0a-199172f4472d","resolution":{"observed_at":"2026-08-07T11:50:54.959124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:54.852001Z","title":"Auto-encoding variational bayes,","venue":null,"work_id":"f793b2a9-df8c-46b6-9c5c-3e509aeb8e50","year":2014},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:44.292851Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:9893f7137e80ba04f4968bd691db0b39736937e654d92defdd75f47f289fef09","observation_id":"f8d51fca-9df8-4d46-b84d-fce2c40bc743","resolution":{"observed_at":"2026-08-07T11:50:54.885773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:54.713263Z","title":"Neural discrete representation learning,","venue":null,"work_id":"381cf5b7-ef40-4493-b76a-f18a5773bb49","year":2017},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:44.360857Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:a6c4b05aa7d7cd18ea1de8045653256c1f8c6d442435face8ce5e34975fc0f77","observation_id":"ba8d278d-edd5-48f2-a2e3-9e8afd98716d","resolution":{"observed_at":"2026-08-07T11:50:54.764813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:54.609347Z","title":"PixArt-α: Fast training of diffusion transformer for photorealistic text-to-image synthesis,","venue":null,"work_id":"18c3a560-439f-4fd2-b1f0-34255e18281c","year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:44.450280Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:e7917dd4a8cc8c4761b8c9ba89a0d805fc0f1a7d1d235e5a2d7432b5ab35fd25","observation_id":"2b9022e7-addd-41df-97c2-e0d9f7f7ac3b","resolution":{"observed_at":"2026-08-07T11:50:54.649748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:54.545133Z","title":"Diffit: Diffusion vision transformers for image generation,","venue":null,"work_id":"7cebee7a-876f-4f1c-a563-1f6c7e78dc03","year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:44.566261Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:6608da039a4c46d16f4c87bffaa3b11b8f21c02fac150883c0a71fe5105b3a54","observation_id":"11232caa-1f1d-4c86-a687-8588160875d4","resolution":{"observed_at":"2026-08-07T11:50:54.578831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:54.498196Z","title":"Attention is all you need,","venue":null,"work_id":"2a05d291-2eb7-4bf3-86d2-f682f7a8e9b5","year":2017},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:44.669214Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:701450e3b3ddfe7876f64ebaeb9a5bb920a7f263e7845388bdd68e2a6028b0e6","observation_id":"6a73e3c9-957e-44ca-ba68-7b4ef8ee648c","resolution":{"observed_at":"2026-08-07T11:50:54.515049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:54.428958Z","title":"Roformer: Enhanced transformer with rotary position embedding,","venue":null,"work_id":"b54d619d-b1db-4da5-98ef-efcadeffc11a","year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:44.756101Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:cb3d4bead7b82bcb2de8b0838721a9db8395a47b10eb5d3c19d4d55910956e55","observation_id":"77afb018-7c60-4abf-aa05-a0a0a26237af","resolution":{"observed_at":"2026-08-07T11:50:54.457677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:44.849006Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:44.849006Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:8b31aace0bf9cb198a4ba14fe1efeaab485b133404975d73e8a60e9726e5b652","observation_id":"bdb9ebfd-7918-488d-aff2-a070448c16c9","resolution":{"observed_at":"2026-08-07T11:50:44.849006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:54.343236Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer,","venue":null,"work_id":"b9587e0b-a950-453e-b6ec-0b4c86f62e39","year":2020},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:44.924904Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:aa6fe2009b4545451ca4f0c72c712384ac35b50a9f60328af3f05af12960e3fa","observation_id":"8e4e23b2-a4c7-45cf-aa10-0ea570a490a2","resolution":{"observed_at":"2026-08-07T11:50:54.370990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-07T11:50:44.993921Z","title":"Gemma 2: Improving open language models at a practical size,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:44.993921Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:8d9e87b2cc0bd9342e40e7f667fe59e18c61da454f4960ac265d5e18bef31cf5","observation_id":"c4b30376-c365-4bf4-be63-0bce8e942056","resolution":{"observed_at":"2026-08-07T11:50:44.993921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:54.265628Z","title":"Generative adver- sarial nets,","venue":null,"work_id":"c1c0dd14-03fa-4396-a0c0-62a1575a58ea","year":2014},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:45.112723Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:de3b6b0fc55c2795e5ebbe6da41dd795502d44b0da0a98ba1b8866d591befc10","observation_id":"bbe466e0-f972-484e-8a06-7be338ae6081","resolution":{"observed_at":"2026-08-07T11:50:54.293267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:54.183883Z","title":"Progressive growing of gans for improved quality, stability, and variation,","venue":null,"work_id":"e1e584a4-f3f9-46d1-a8ce-1736a6da5506","year":2018},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:45.194465Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:2abea006f8fcbc0d6accf14028de09eff79ff2063ce9045f72710742783d81e9","observation_id":"3f65d07c-672e-4eae-a6af-d965bf44a3a1","resolution":{"observed_at":"2026-08-07T11:50:54.233854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:54.077406Z","title":"Large scale gan training for high fidelity natural image synthesis,","venue":null,"work_id":"e06ddba5-3d42-4887-b6c6-1780e38197ff","year":2019},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:45.279309Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:2761043551379650b564bebf4e3e708f486aea254bb55663329e6701052f4fb0","observation_id":"bdbb8d21-927a-424d-bee2-11b9753c9fbc","resolution":{"observed_at":"2026-08-07T11:50:54.127020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:53.927828Z","title":"A style-based generator architec- ture for generative adversarial networks,","venue":null,"work_id":"42c42eb2-30c8-48a9-b67f-866c5c20cc29","year":2019},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:45.377226Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:189cfc782972133059afb6546c068029763b90105a9113121249750f8e3bba73","observation_id":"b58c257c-0f95-4a46-8f95-80b0e737aaf9","resolution":{"observed_at":"2026-08-07T11:50:53.998622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:53.843210Z","title":"Analyzing and improving the image quality of stylegan,","venue":null,"work_id":"48eb5d86-96ce-4653-94ee-aecf6f686063","year":2020},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:45.474101Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:36df9cf85d01d8da3f6406d7a44db7d88abb5788ce5f634f1f61c844eb914f72","observation_id":"abfbff86-1369-4093-8d93-ed640c64fd2d","resolution":{"observed_at":"2026-08-07T11:50:53.875739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:53.733740Z","title":"Alias-free generative adversarial networks,","venue":null,"work_id":"2719e728-f501-457d-9d80-946c33c10efe","year":2021},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:45.565993Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:aa2340a28f69dab0bdde80c85c676371796316845df47f9b4a5948b71d4ec5ff","observation_id":"1982e905-b85a-470a-844a-0383a9defe0f","resolution":{"observed_at":"2026-08-07T11:50:53.776270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:53.631380Z","title":"Any- resolution training for high-resolution image synthesis,","venue":null,"work_id":"53c7db7a-1e3f-499a-afd3-7432df37fd99","year":2022},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:45.632229Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:6f09e7ee66fbd23e6902675d90cb4a620b0a6584d701dde56c0002ec01a4c08d","observation_id":"b8ef4985-16be-4050-8f12-466649ad6ec5","resolution":{"observed_at":"2026-08-07T11:50:53.682391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:53.522344Z","title":"Scaling up gans for text-to-image synthesis,","venue":null,"work_id":"05b2fe79-80bc-46f3-8207-7210cfbc3ec7","year":2023},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:45.726221Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:178f46217dd078988093d6a9af1a5f0e1ffaf15dfeb5298e083e0d62499bbaba","observation_id":"31a89c72-810a-47f4-b0f2-80c62a29679b","resolution":{"observed_at":"2026-08-07T11:50:53.576063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:53.431135Z","title":"Generating diverse high-fidelity images with vq-vae-2,","venue":null,"work_id":"ffa2fa34-3c28-461d-819c-c39223413dbe","year":2019},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:45.820581Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:51d7c2f421036076289cf7437783b3c463597250103cceb8664575eff654dd26","observation_id":"6e7817a4-25a4-4cde-a800-f7861fe54acd","resolution":{"observed_at":"2026-08-07T11:50:53.468258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:53.304307Z","title":"Zero-shot text-to-image generation,","venue":null,"work_id":"99a309a2-4d02-487f-9ff6-d1b32e6f601c","year":2021},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:45.946167Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:f22fb2812cb163f6b9cb2f8e9aafba46983a70473abe6723f768159425fa2313","observation_id":"7d80355b-5a0b-454c-929d-d93d58299f23","resolution":{"observed_at":"2026-08-07T11:50:53.365331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:53.207519Z","title":"Muse: Text-to-image generation via masked generative trans- formers,","venue":null,"work_id":"be8cf92a-db0a-4588-8536-c52a58e955ce","year":2023},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:46.062428Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:400a46ac9b9edcee97213aae5d8d7dd14410f73f7cf2b92414b56fbff5659d1b","observation_id":"ae9dc62a-ffb3-4b68-aaaa-a9f414a5099a","resolution":{"observed_at":"2026-08-07T11:50:53.245262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:53.101859Z","title":"Scaling autoregressive models for content-rich text-to-image generation,","venue":null,"work_id":"3a3c275c-e360-4338-af9e-f6480b4b0d45","year":2022},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:46.144024Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:549db74e3fc21f35cf59eecf95d5a355e5153e85ca68c470cefba133b1147c4d","observation_id":"946160b9-7c15-4be7-a976-b945c6d7e07f","resolution":{"observed_at":"2026-08-07T11:50:53.151023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:53.003930Z","title":"Visual au- toregressive modeling: Scalable image generation via next-scale prediction,","venue":null,"work_id":"c24948ba-6beb-47ee-a06a-36e32abe22ec","year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:46.230898Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:0e36132d478935bf7bb53a0618db27848fc8ddcdbd578d042ce9de28e33b32fd","observation_id":"9942e099-47c8-4d83-a8a6-21c75ff80bef","resolution":{"observed_at":"2026-08-07T11:50:53.055325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:52.926462Z","title":"Autoregressive image generation without vector quantization,","venue":null,"work_id":"2bd4cab6-0711-4807-b353-031038c6b717","year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:46.312571Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:0c6a15e3d093d87d332962cf4990be61ba14a8e64dee9aee0c74409e51923309","observation_id":"5457dfe6-1000-46bd-9137-485d7e0ed9c4","resolution":{"observed_at":"2026-08-07T11:50:52.953758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:46.448199Z","title":"Adversarial diffusion distillation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:46.448199Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:a0bc0af7e9374a47b41fc536f80417d53a8bfca44eee7f49f8d6129bca998070","observation_id":"16e96873-fdb2-4463-83ac-310c1c5f498a","resolution":{"observed_at":"2026-08-07T11:50:46.448199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:52.821364Z","title":"Fast high-resolution image synthesis with latent adversarial diffusion distillation,","venue":null,"work_id":"2db62363-2d8f-404b-b6f4-b9de42e0f2f8","year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:46.559304Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:55aa6b84c7c16573950297c68532316665095ac25e141a5878e15da08b5709cc","observation_id":"81a29d95-21b2-49c3-af90-b773f7329cb0","resolution":{"observed_at":"2026-08-07T11:50:52.850798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:52.727463Z","title":"Multidiffusion: Fusing diffusion paths for controlled image generation,","venue":null,"work_id":"abeb3382-7d87-4ccb-83c6-b7d3683426d0","year":2023},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:46.663632Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:bda2a3ceb5464bb46d3ef23323edab1d37652ce3010f9bb3c51e17d55e89bcaf","observation_id":"1af65e15-4806-4c4f-850e-90ce7c2070d9","resolution":{"observed_at":"2026-08-07T11:50:52.765336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:52.607336Z","title":"Demo- fusion: Democratising high-resolution image generation with no $$$,","venue":null,"work_id":"c4e89caa-f9f3-489f-8396-42a01cfb967b","year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:46.763564Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:d80874609a00d83e9e4de8f75acc41ce629cc75a47b3f579abc90f0f19378a15","observation_id":"476dd520-2d4a-4e0e-b82c-03dffa9d3ba1","resolution":{"observed_at":"2026-08-07T11:50:52.647379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:52.488566Z","title":"Elasticdiffusion: Training-free arbitrary size image generation through global-local content separation,","venue":null,"work_id":"ca9b86a9-8035-4730-a85d-83c2e8c0992c","year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:46.874881Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:690c4639338ef62fd7f683f81dc873dc0d99e079f8db45923c2685a0c901a16e","observation_id":"696c9081-024e-44e9-84b8-b71e4195630d","resolution":{"observed_at":"2026-08-07T11:50:52.541211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:52.398435Z","title":"W ¨urstchen: An efficient architecture for large-scale text-to-image diffusion models,","venue":null,"work_id":"fdd849c9-7e49-4b6c-9626-362e8d1039da","year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:47.027728Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:7c312b82fc7e285fbc2b3c0fc8959e511c82de149b1ebc978cda84ad6215b951","observation_id":"0749e789-b2b3-4afe-9602-595f7294eaf6","resolution":{"observed_at":"2026-08-07T11:50:52.436613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:52.307402Z","title":"Deep compression autoencoder for efficient high- resolution diffusion models,","venue":null,"work_id":"6190689f-7b24-4231-b94a-9f3271b7f728","year":2025},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:47.108874Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:1c9c626e618987b442c0e20c7d6981a634e20394cb9b5a623b435870027f0e35","observation_id":"61e9254d-6c47-4931-8298-5f08711a7467","resolution":{"observed_at":"2026-08-07T11:50:52.356000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:52.224156Z","title":"The unreasonable effectiveness of deep features as a perceptual met- ric,","venue":null,"work_id":"16be5645-74c5-4207-a337-bf622fd016bb","year":2018},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:47.185436Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:738119587331b86fd45223bef8a64ec8ac9321ee129510bb2431e3acda1968f7","observation_id":"082417fd-2065-4fe9-8ec9-cfada5f523bd","resolution":{"observed_at":"2026-08-07T11:50:52.259465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:52.067034Z","title":"Image-to-image trans- lation with conditional adversarial networks,","venue":null,"work_id":"c0950f27-7169-4cec-98dd-63f50efe9ba1","year":2017},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:47.288563Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:55d60ca8076112e6b2116d3787c36c3d20d84a0e497a0f1e0bfed3984d45ad74","observation_id":"20510c26-bd88-4dfa-9cd9-55b66d309e00","resolution":{"observed_at":"2026-08-07T11:50:52.159683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:51.902831Z","title":"Wavelet score-based generative modeling,","venue":null,"work_id":"2b167b31-0216-44cd-9d4b-ea930c3e9305","year":2022},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:47.369247Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:a1d60a68aff5a8ac7d568a62f5d4911b03f48beac7adca7534514c318fa04d63","observation_id":"88db926b-d7e3-4262-b2e4-68746ba8fcc7","resolution":{"observed_at":"2026-08-07T11:50:51.964764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:51.797542Z","title":"Wavelet diffusion models are fast and scalable image generators,","venue":null,"work_id":"03ef8320-befd-4041-aeea-880cbaf13bf0","year":2023},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:47.438477Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:5b8fa72a0fab71409d6c461aa8b9931329bbcef492aa223ad24a40d9f9eb6fdd","observation_id":"420e939f-ca82-4b9b-a19b-3e00236a4442","resolution":{"observed_at":"2026-08-07T11:50:51.847093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:51.714881Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation,","venue":null,"work_id":"ebe322ca-2ca3-446b-9bd1-ff7253533137","year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:47.544490Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:d129371a6b20e416d885a84077f7cc552c32e8898c64c1d0bf20b586ceee73fc","observation_id":"a650deaf-49f6-40ed-b9a5-a2d592386cce","resolution":{"observed_at":"2026-08-07T11:50:51.749376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:51.513881Z","title":"Textons, the elements of texture perception, and their interactions,","venue":null,"work_id":"d09c4c03-23c5-4297-b092-8b504e0959e0","year":1981},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:47.663394Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:3beb97dd87f18c17101c46d36a69b2509064ef2f03ab017e9b1d3a3d8995a40b","observation_id":"2afae7c6-e305-4f30-86d1-cf7259521dbe","resolution":{"observed_at":"2026-08-07T11:50:51.609917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:51.333048Z","title":"Stockwell,T exture-a cognitive aesthetics of reading","venue":null,"work_id":"e2ea14cf-22ab-4037-bcbe-0e547b9c07aa","year":2020},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:47.776217Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:93a1e72c4b87f3ee2cb30a3f7bd51c482e8888384dd50bd4442905e322120988","observation_id":"b1d0f2b3-d8af-4785-b004-8c46afaa3e56","resolution":{"observed_at":"2026-08-07T11:50:51.425918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:51.152495Z","title":"Early vision and texture percep- tion,","venue":null,"work_id":"7c56ee7f-b7dd-4ffd-b771-db94ae8851b9","year":1988},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:47.897366Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:513c207cb5a0d144456a654b03b2316d20e42c97218e72b6952976e023a7a4e1","observation_id":"82f8329f-511e-4dd7-b071-9fe183e9dd2a","resolution":{"observed_at":"2026-08-07T11:50:51.238182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:51.014490Z","title":"Image quality analysis using glcm,","venue":null,"work_id":"bfed400e-b06e-4a1f-8289-31e6f41147a9","year":2004},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:48.011820Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:2d3aee4389668ea9f1aa2a395998ed8aa0ba27edad7195dfa969119d94c6e008","observation_id":"266e67d0-ae0d-4116-be69-f62fa554f287","resolution":{"observed_at":"2026-08-07T11:50:51.100781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:50.890148Z","title":"Textural features for image classification,","venue":null,"work_id":"763344c1-fddb-4757-9826-3bc04ef03bd7","year":1973},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:48.081783Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:0d02b3ed632b4ab030cd0b9e70ee27313c53cb5610e077c656288bddfb87786e","observation_id":"b6d692a6-ab76-4ac8-a62c-2bd7296f3923","resolution":{"observed_at":"2026-08-07T11:50:50.947654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:50.759472Z","title":"Musiq: Multi- scale image quality transformer,","venue":null,"work_id":"db6f963d-d0fb-4cb1-ba39-6c9b063450a6","year":2021},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:48.184182Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:7cf35223c369c7a4b77b25449271a941d6863dbe4805fefc348abcc92de572e1","observation_id":"a78ced6a-fe12-4ff8-9bf2-b95d3864bd6b","resolution":{"observed_at":"2026-08-07T11:50:50.815741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:50.630937Z","title":"Maniqa: Multi-dimension attention network for no- reference image quality assessment,","venue":null,"work_id":"dbd9db78-1207-4fb3-900d-f5a6b87516e0","year":2022},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:48.301300Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:72f849dff2f834be1de1286fc342c27405ab260de000991a13845d69f3741b35","observation_id":"73963c43-6520-47a5-b1b9-8fb979e244cb","resolution":{"observed_at":"2026-08-07T11:50:50.662109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:50.513962Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation,","venue":null,"work_id":"11f42074-b513-4dda-8707-8edbee321dd4","year":2023},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:48.413223Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:739272d3a334410e3beb161ff29ffcbf5d49e765b67f83bef356ea6e11aacad6","observation_id":"56f2824c-9911-4199-ba19-24459656e3ad","resolution":{"observed_at":"2026-08-07T11:50:50.567044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:50.352196Z","title":"Human preference score: Better aligning text-to-image models with human prefer- ence,","venue":null,"work_id":"ecd45953-4547-4bee-a8cc-99f941970f96","year":2023},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:48.555790Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:d96b79d74a8eec068f3bebeeb183bb758bec83f7417ca27c4080e11cc5d45952","observation_id":"8f3fbb53-e0e1-4603-b0f9-e2749c29e28d","resolution":{"observed_at":"2026-08-07T11:50:50.437437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:50.188459Z","title":"Rich human feedback for text-to-image generation,","venue":null,"work_id":"78a6257a-d2be-43e1-a015-0e36199f12c1","year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:48.690351Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:22e03da7ab8df8f10b988530a74ff047431bbd8d8499fe5003cfb9c367c41072","observation_id":"e36924fa-203b-4802-87aa-a226b0808349","resolution":{"observed_at":"2026-08-07T11:50:50.254752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:50.023746Z","title":"Decoupled weight decay regulariza- tion,","venue":null,"work_id":"ea7bc453-f42c-44ae-abe9-7493f8e2541c","year":2019},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:48.769981Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:f9d78ed2480df304eb4a280ae21ed6a19368e440fc9ffce3105992295a7ccb1b","observation_id":"ecea5789-95db-46eb-abb2-8c29083ad30d","resolution":{"observed_at":"2026-08-07T11:50:50.097009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:49.901591Z","title":"Zero: Memory optimizations toward training trillion parameter models,","venue":null,"work_id":"b1d46efe-bfae-48d5-b16e-1c20c46cd002","year":2020},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:48.874433Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:82cf98b4724f0d51b4f8d2d0d0fa7138ba30f021f7b3da10ab74672943727873","observation_id":"4271b242-2079-472d-af4e-1777b697554e","resolution":{"observed_at":"2026-08-07T11:50:49.956893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:49.791830Z","title":"Zero-Offload: Democratizing billion- scale model training,","venue":null,"work_id":"16924078-274a-4b56-873b-8322c1f3b44b","year":2021},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:48.969598Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:b8269fd05d285ddbf496e64483ec1ddc3e6c3d6a1b22d21eeddcdcf0955da9dd","observation_id":"3c5636ed-efa2-4677-9988-51a382d26f9c","resolution":{"observed_at":"2026-08-07T11:50:49.832480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:49.690019Z","title":"Image quality assessment: from error visibility to structural similarity,","venue":null,"work_id":"2ffa90a1-db73-4c82-9fc6-66e677cb9556","year":2004},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:49.034458Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:fd3c474964c86991c6be985856dd902f7c0938830480f29b01b22ca0a484cf58","observation_id":"98af19f1-2b32-42b3-881e-f7f45af0ed9e","resolution":{"observed_at":"2026-08-07T11:50:49.722702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:50:49.527549Z","title":"(2024) Sora","venue":null,"work_id":"eff28947-59f2-4b19-a3e7-ec62d04982b1","year":2024},"citing_paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:49.088441Z"},"links":{"citing_paper":"/paper/2506.01331"},"observation_digest":"sha256:da80ab65b147c91f68669ed4a13a8fa42f59cf10051257cfaa379c57538f4246","observation_id":"ac53fca1-9ac0-4287-9d6e-99d956c2e54c","resolution":{"observed_at":"2026-08-07T11:50:49.600671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.01331","last_updated":"2025-06-02T05:19:40Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T15:58:33.395067Z","submitted_at":"2025-06-02T05:19:40Z","title":"Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation"},"reference_resolution":{"displayed":89,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":70},"total_outbound_references":89},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 89 of 89 outbound references and 3 inbound Pith citation observations for arXiv:2506.01331."}